Sécuriser les frontières d'un LLM
Ce qui entre dans un prompt et ce qui sort d'une réponse sont deux surfaces d'attaque distinctes.
-
1
Concept
Injection de prompt : défense
L'injection de prompt n'est pas un bug qu'on corrige, c'est une classe d'attaque qu'on atténue. Les vecteurs réels et les défenses qui marchent vraiment.
-
2
Actualité
Sortie IA : le nouveau XSS
Un talk SymfonyCon pointe un angle mort : on échappe l'input utilisateur par réflexe, mais on rend la sortie d'un LLM en confiance aveugle. C'est pourtant la même XSS, avec une source de plus.
-
3
Concept
Sandboxer les tool calls
Une fois que le LLM a décidé d'appeler un tool avec certains arguments, tout se joue dans le code qui exécute cette décision. Trois couches concrètes en PHP : dispatch fermé, validation du schéma, isolation par processus.