Un agent a halluciné une attaque, il nous a fallu trois heures pour le prouver
Un sous-agent IA invente une instruction malveillante de toutes pièces. Récit d'une investigation forensique pour distinguer hallucination et compromission réelle.
6 articles
Un sous-agent IA invente une instruction malveillante de toutes pièces. Récit d'une investigation forensique pour distinguer hallucination et compromission réelle.
Agent Skills est un format ouvert qui permet d'injecter des instructions contextuelles dans les agents IA. Présentation du standard, de son architecture progressive disclosure, et de skill-creator pour industrialiser leur production.
RTK compresse les sorties des outils. Caveman réduit la verbosité du LLM. DCP élague l'historique. Trois outils, trois couches — et un argument contre-intuitif : moins de tokens, meilleur raisonnement.
Comment donner à un agent IA tous les outils pour exécuter, analyser et voir ton application — et devenir vraiment autonome dans la détection et correction d'erreurs.
Un deep dive dans le review-manager de opencode-team-lead — sélection des reviewers, isolation des contextes, arbitrage des désaccords, et production d'un verdict structuré sans jamais lire une ligne de code.
Sur des tâches longues, un agent all-in-one se perd et s'auto-review avec les mêmes biais que ceux qui ont produit le code. J'ai construit opencode-team-lead pour résoudre ces deux problèmes avec un pattern de délégation stricte.