Fenêtre de contexte
aussi appelé : context window, contexte
La quantité maximale d'information qu'un modèle peut « avoir en tête » dans une conversation — sa mémoire de travail, mesurée en tokens.
Les modèles récents tiennent l'équivalent de plusieurs livres en mémoire de travail. Mais attention : la fenêtre se vide à chaque nouvelle conversation. C'est pour ça que le second brain existe — plutôt que de tout redire, tes agents rechargent ton contexte depuis des fichiers à chaque démarrage.
Exemple concretChaque agent de notre flotte démarre en lisant les fichiers du brain qui concernent sa mission — jamais tout le vault, juste sa part. C'est ce qui garde les coûts bas et les réponses pertinentes.
fondamentaux