1. 1
    Tutoriel

    Tester un appel LLM

    Comment tester du code qui appelle un LLM sans payer des tokens à chaque run ni dépendre d'une réponse non déterministe. Doublures, golden tests, et ce qu'on teste vraiment.

  2. 2
    Tutoriel

    JSON fiable depuis un LLM

    Obtenir du JSON structuré et valide d'un LLM de façon fiable : schéma dans le prompt, validation stricte, retry ciblé. Le pattern qui tient en prod.

  3. 3
    Tutoriel

    Streaming SSE en PHP natif

    Streamer les tokens d'un LLM vers le navigateur en Server-Sent Events, sans framework ni librairie. Le pattern, les pièges de buffering, et le code complet.

  4. 4
    Tutoriel

    Logger un LLM sans dépendance

    Un wrapper PHP minimaliste pour logger chaque appel LLM (prompt, réponse, tokens, latence, coût) dans une table SQL. Compatible PSR-3, lisible, debuggable.

  5. 5
    Concept

    Prompt versioning en prod

    Un prompt est du code qui décide du comportement de ton produit. Le laisser en string hardcodée non versionnée est une dette. Comment traiter les prompts comme des artefacts.

  6. 6
    Tutoriel

    Rate limiting d'une API LLM

    Rester sous les quotas d'un provider LLM sans tout casser : token bucket en PHP, gestion du 429, et la différence entre limite de requêtes et limite de tokens.

  7. 7
    Concept

    Idempotence des appels LLM

    Un retry sur un appel LLM peut facturer deux fois, dupliquer une action, envoyer deux emails. Pourquoi l'idempotence n'est pas optionnelle dès qu'il y a des effets de bord.

  8. 8
    Concept

    Fallback multi-modèle

    Un provider LLM tombe ou te 429 en plein pic. Sans plan de repli, ton produit tombe avec lui. Patterns de dégradation gracieuse entre modèles et providers.

  9. 9
    Concept

    Observabilité d'un agent

    Un agent qui boucle sur des tools est une boîte noire si tu ne traces rien. Ce qu'il faut logger pour pouvoir débugger, optimiser et facturer.

  10. 10
    Tutoriel

    Symfony Messenger + agent IA

    Mettre les appels LLM dans une queue Symfony Messenger pour découpler l'API utilisateur des temps de réponse imprévisibles. Setup minimal et patterns testés en production.