Observabilité d'un agent
Un agent qui boucle sur des tools est une boîte noire si tu ne traces rien. Ce qu'il faut logger pour pouvoir débugger, optimiser et facturer.
L'ensemble des articles publiés, du plus récent au plus ancien.
Un agent qui boucle sur des tools est une boîte noire si tu ne traces rien. Ce qu'il faut logger pour pouvoir débugger, optimiser et facturer.
Tout le monde veut un « agent » alors qu'un workflow scripté suffit dans 80 % des cas. Critères concrets pour choisir l'un ou l'autre, et pourquoi le mauvais choix coûte cher.
L'injection de prompt n'est pas un bug qu'on corrige, c'est une classe d'attaque qu'on atténue. Les vecteurs réels et les défenses qui marchent vraiment.
Pinecone ou Qdrant pour 5 000 documents, c'est de l'over-engineering. Stocker les vecteurs en MySQL et faire la similarité cosinus en SQL ou PHP : quand ça suffit, et le code.
Le RAG naïf et le tool use direct résolvent des problèmes proches mais pas identiques. Comparaison côte à côte et conseils pour choisir selon ton volume de données et tes besoins de fraîcheur.
Cacher les réponses LLM par similarité d'embedding plutôt que par clé exacte : gros gains de coût, mais des pièges réels. Quand l'utiliser, quand l'éviter.
Un retry sur un appel LLM peut facturer deux fois, dupliquer une action, envoyer deux emails. Pourquoi l'idempotence n'est pas optionnelle dès qu'il y a des effets de bord.
MCP expose trois primitives : tools, resources, prompts. Quelle différence, et quand utiliser laquelle. Un point souvent flou même chez les implementeurs.
Rester sous les quotas d'un provider LLM sans tout casser : token bucket en PHP, gestion du 429, et la différence entre limite de requêtes et limite de tokens.