Concept

Observabilité d'un agent

Un agent qui boucle sur des tools est une boîte noire si tu ne traces rien. Ce qu'il faut logger pour pouvoir débugger, optimiser et facturer.

Concept

Agent vs workflow

Tout le monde veut un « agent » alors qu'un workflow scripté suffit dans 80 % des cas. Critères concrets pour choisir l'un ou l'autre, et pourquoi le mauvais choix coûte cher.

Concept

Injection de prompt : défense

L'injection de prompt n'est pas un bug qu'on corrige, c'est une classe d'attaque qu'on atténue. Les vecteurs réels et les défenses qui marchent vraiment.

Tutoriel

Embeddings sans vector DB

Pinecone ou Qdrant pour 5 000 documents, c'est de l'over-engineering. Stocker les vecteurs en MySQL et faire la similarité cosinus en SQL ou PHP : quand ça suffit, et le code.

Concept

RAG vs tool use direct

Le RAG naïf et le tool use direct résolvent des problèmes proches mais pas identiques. Comparaison côte à côte et conseils pour choisir selon ton volume de données et tes besoins de fraîcheur.

Concept

Cache sémantique pour LLM

Cacher les réponses LLM par similarité d'embedding plutôt que par clé exacte : gros gains de coût, mais des pièges réels. Quand l'utiliser, quand l'éviter.

Concept

Idempotence des appels LLM

Un retry sur un appel LLM peut facturer deux fois, dupliquer une action, envoyer deux emails. Pourquoi l'idempotence n'est pas optionnelle dès qu'il y a des effets de bord.

Concept

MCP : tools vs resources

MCP expose trois primitives : tools, resources, prompts. Quelle différence, et quand utiliser laquelle. Un point souvent flou même chez les implementeurs.

Tutoriel

Rate limiting d'une API LLM

Rester sous les quotas d'un provider LLM sans tout casser : token bucket en PHP, gestion du 429, et la différence entre limite de requêtes et limite de tokens.