<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"><channel><title>Rachid Chabane · Articles</title><description>Blog d&apos;ingénierie IA · agents, RAG, systèmes</description><link>https://rachid-chabane.com/</link><language>fr-FR</language><item><title>MCP passe sans état pour un problème que la plupart d&apos;entre nous n&apos;avions pas</title><link>https://rachid-chabane.com/fr/blog/mcp-noyau-sans-etat-routage-par-en-tetes/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/mcp-noyau-sans-etat-routage-par-en-tetes/</guid><description>La réécriture sans état de MCP est un rattrapage, et la facture de migration tombe sur des équipes qui n&apos;ont jamais eu le problème qu&apos;elle résout. La spécification annonce la…</description><pubDate>Wed, 29 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Ce que les chiffres AFD de vLLM exigent de votre interconnexion</title><link>https://rachid-chabane.com/fr/blog/ce-que-les-chiffres-afd-de-vllm-exigent-de-votre-interconnexion/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/ce-que-les-chiffres-afd-de-vllm-exigent-de-votre-interconnexion/</guid><description>Le +11.3 % que le plugin AFD de vLLM rapporte en 64A16F [s1] ne se transporte pas jusqu&apos;à votre cluster, et la publication ne livre pas de quoi le mériter. Par rapport à EP64, le…</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Votre réponse à incident dépend de la politique de contenu d&apos;un fournisseur</title><link>https://rachid-chabane.com/fr/blog/votre-reponse-a-incident-depend-de-la-politique-de-contenu-d-un-fournisseur/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/votre-reponse-a-incident-depend-de-la-politique-de-contenu-d-un-fournisseur/</guid><description>Les intervenants de Hugging Face n&apos;ont pas pu analyser leur propre incident via les API commerciales, donc le comportement de refus ne figure plus dans mes jeux de contrôles. La…</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Comptez les actions irréversibles qu&apos;un agent exécute avant de s&apos;arrêter</title><link>https://rachid-chabane.com/fr/blog/compter-les-actions-irreversibles-avant-l-arret-de-l-agent/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/compter-les-actions-irreversibles-avant-l-arret-de-l-agent/</guid><description>Le score d&apos;abstention publié par un benchmark est un taux, et le nombre qui décide du câblage d&apos;un agent est le nombre d&apos;actions irréversibles exécutées avant son arrêt. La…</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Un holdout privé SWE-bench déplace le problème de confiance vers son auteur</title><link>https://rachid-chabane.com/fr/blog/un-holdout-prive-swe-bench-ne-restaure-pas-la-confiance/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/un-holdout-prive-swe-bench-ne-restaure-pas-la-confiance/</guid><description>Un holdout privé et résistant à la contamination réduit le risque de fuite tout en livrant un score qu&apos;aucun tiers ne peut vérifier. J&apos;y vois un échange : on achète la résistance…</description><pubDate>Fri, 24 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Kimi K3 est classé quatrième, et personne n&apos;a mesuré le modèle que vous feriez tourner</title><link>https://rachid-chabane.com/fr/blog/kimi-k3-classe-quatrieme-personne-na-mesure-les-poids/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/kimi-k3-classe-quatrieme-personne-na-mesure-les-poids/</guid><description>Tous les chiffres publics de Kimi K3 décrivent une API louée, pas le fichier de poids attendu pour le 27 juillet. Artificial Analysis attribue au modèle un score de 57 sur son…</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Votre agent regarde le bon outil et se trompe quand même</title><link>https://rachid-chabane.com/fr/blog/votre-agent-regarde-le-bon-outil-et-se-trompe-quand-meme/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/votre-agent-regarde-le-bon-outil-et-se-trompe-quand-meme/</guid><description>Si votre agent a choisi le mauvais outil, la formulation de vos descriptions d&apos;outils n&apos;y est presque pour rien. Dans une étude de 2026, la réparation par le prompt récupère au…</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Ce n&apos;est pas la structure de votre CLAUDE.md qui explique l&apos;oubli de l&apos;agent</title><link>https://rachid-chabane.com/fr/blog/arretez-de-retoucher-claude-md/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/arretez-de-retoucher-claude-md/</guid><description>Ce n&apos;est pas la structure de votre CLAUDE.md qui explique l&apos;oubli de l&apos;agent. Chaque fonction supplémentaire générée s&apos;accompagne d&apos;une baisse d&apos;environ 5,6 % des chances que…</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Votre défense contre l&apos;injection n&apos;a jamais affronté un attaquant qui s&apos;adapte</title><link>https://rachid-chabane.com/fr/blog/couche-de-defense-injection/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/couche-de-defense-injection/</guid><description>Les trois résultats de mi-2026 qui ressemblent à une querelle générale sur la défense contre le prompt injection ne se contredisent pas, et nommer la couche que chacun attaque…</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Plus 24 pour cent et moins 19 pour cent sont vrais tous les deux</title><link>https://rachid-chabane.com/fr/blog/plus-24-pour-cent-et-moins-19-pour-cent-sont-vrais/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/plus-24-pour-cent-et-moins-19-pour-cent-sont-vrais/</guid><description>Il n&apos;existe aucun chiffre de productivité transposable pour les agents de code : dans cet état des preuves, l&apos;instrument pèse plus lourd que l&apos;outil, et le choix du proxy décide…</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate></item><item><title>La denylist de votre agent vérifie une chaîne que le shell réécrit</title><link>https://rachid-chabane.com/fr/blog/la-denylist-de-votre-agent-verifie-une-chaine-que-le-shell-reecrit/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/la-denylist-de-votre-agent-verifie-une-chaine-que-le-shell-reecrit/</guid><description>La configuration d&apos;auto-approbation que vous avez livrée ce trimestre vérifie une chaîne que bash n&apos;a pas fini de réécrire. Votre garde-fou et votre shell ne parlent pas de la…</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Le harnais bat le modèle de 4,6 points de presque rien</title><link>https://rachid-chabane.com/fr/blog/pas-de-meilleur-agent-de-code-seulement-un-meilleur-pour-cette-charge/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/pas-de-meilleur-agent-de-code-seulement-un-meilleur-pour-cette-charge/</guid><description>L&apos;analyse que tout le monde cite pour prouver que le harnais l&apos;emporte sur le modèle attribue au harnais environ 5,3 % de la variation du succès et au modèle 0,7 % [s2] : un…</description><pubDate>Wed, 15 Jul 2026 00:00:00 GMT</pubDate></item><item><title>La récompense est le maillon faible de votre agent de code</title><link>https://rachid-chabane.com/fr/blog/la-verification-est-le-nouveau-goulot-des-agents/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/la-verification-est-le-nouveau-goulot-des-agents/</guid><description>Le plus dur, quand on entraîne un agent de code, n&apos;est plus de générer une solution, c&apos;est d&apos;en vérifier une, et ce simple déplacement casse en silence la recette de récompense…</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate></item><item><title>La plupart des gains de raisonnement du multi-agent sont un artefact de calcul</title><link>https://rachid-chabane.com/fr/blog/les-gains-du-multi-agent-sont-un-artefact-de-calcul/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/les-gains-du-multi-agent-sont-un-artefact-de-calcul/</guid><description>Normalisez le budget de jetons de réflexion et l&apos;avantage de raisonnement multi-saut que l&apos;on prête à l&apos;orchestration multi-agent cesse d&apos;apparaître de façon fiable [s1]. Ce seul…</description><pubDate>Mon, 13 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Les agents de revue de code optimisent la mauvaise métrique</title><link>https://rachid-chabane.com/fr/blog/agents-de-revue-de-code-optimisent-la-mauvaise-metrique/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/agents-de-revue-de-code-optimisent-la-mauvaise-metrique/</guid><description>L&apos;argument de vente d&apos;un agent de revue de code, c&apos;est qu&apos;il lit chaque pull request à votre place. Une étude empirique portant sur 13 d&apos;entre eux renverse cet argument : 60,2 %…</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Où investir votre budget de sécurité quand un agent écrit dans votre CI/CD</title><link>https://rachid-chabane.com/fr/blog/la-faille-de-claude-code-action-etait-un-bug-d-autorisation/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/la-faille-de-claude-code-action-etait-un-bug-d-autorisation/</guid><description>La faille de Claude Code Action a exigé deux conditions pour aboutir, une injection de prompt et un contrôle d&apos;autorisation cassé, et la prochaine heure de revue doit aller sur…</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate></item><item><title>L&apos;observabilité n&apos;est pas de l&apos;évaluation</title><link>https://rachid-chabane.com/fr/blog/observabilite-nest-pas-evaluation/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/observabilite-nest-pas-evaluation/</guid><description>Acheter un tableau de bord d&apos;observabilité, ce n&apos;est pas savoir que votre agent a raison, et c&apos;est pourtant le troc que la plupart des équipes concluent en silence. Deux enquêtes…</description><pubDate>Tue, 07 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Le classement de code mesure en partie la manipulation du harnais</title><link>https://rachid-chabane.com/fr/blog/classements-de-code-mesurent-le-gaming-du-harnais/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/classements-de-code-mesurent-le-gaming-du-harnais/</guid><description>Le rang d&apos;un agent sur un classement de code est en partie une note de triche, et cette triche augmente avec la capacité au lieu de s&apos;estomper à mesure que les modèles…</description><pubDate>Mon, 06 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Le score mémoire de votre agent note le rappel, pas la confiance</title><link>https://rachid-chabane.com/fr/blog/benchmarks-memoire-agent-notent-le-rappel-pas-la-confiance/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/benchmarks-memoire-agent-notent-le-rappel-pas-la-confiance/</guid><description>Un 92,5 au benchmark mémoire LoCoMo vous dit que votre agent sait retrouver un fait, et presque rien sur sa tendance à continuer de le servir avec pleine confiance une fois qu&apos;il…</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate></item><item><title>La dette d&apos;agent est un problème de placement de la vérification</title><link>https://rachid-chabane.com/fr/blog/la-dette-d-agent-est-un-probleme-de-placement-de-verification/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/la-dette-d-agent-est-un-probleme-de-placement-de-verification/</guid><description>Quatre-vingt-quatorze pour cent des responsables jugent le code produit par IA de meilleure qualité que le code écrit par des humains au moment de la revue, et pourtant 82 %…</description><pubDate>Sat, 04 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Les agents de code échouent au niveau du harnais, pas du modèle</title><link>https://rachid-chabane.com/fr/blog/les-agents-echouent-au-niveau-du-harnais-pas-du-modele/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/les-agents-echouent-au-niveau-du-harnais-pas-du-modele/</guid><description>La prochaine version du modèle ne réparera pas votre agent de code, car les défaillances qui vous coûtent cher ne sont pas celles qu&apos;un modèle plus puissant corrige. Ce sont des…</description><pubDate>Thu, 02 Jul 2026 00:00:00 GMT</pubDate></item><item><title>MCP a gagné par la simplicité et déplacé la frontière de confiance vers le client</title><link>https://rachid-chabane.com/fr/blog/mcp-a-deplace-la-frontiere-de-confiance-vers-le-client/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/mcp-a-deplace-la-frontiere-de-confiance-vers-le-client/</guid><description>MCP a rendu triviale la connexion d&apos;un agent à ses outils en faisant confiance aux descriptions d&apos;outils du serveur, et ce choix par défaut a déplacé sans bruit la frontière de…</description><pubDate>Wed, 01 Jul 2026 00:00:00 GMT</pubDate></item><item><title>Le cache de prompt peut ralentir votre agent</title><link>https://rachid-chabane.com/fr/blog/le-cache-de-prompt-peut-ralentir-votre-agent/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/le-cache-de-prompt-peut-ralentir-votre-agent/</guid><description>Vous activez le cache de prompt en attendant que la facture baisse et que la latence diminue, et la plupart du temps c&apos;est ce qui se produit. Mais la première étude contrôlée…</description><pubDate>Tue, 30 Jun 2026 00:00:00 GMT</pubDate></item><item><title>GLM-5.2 referme l&apos;écart sur le code. Le piège, c&apos;est où vous l&apos;exécutez.</title><link>https://rachid-chabane.com/fr/blog/glm-5-2-ou-vous-l-executez/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/glm-5-2-ou-vous-l-executez/</guid><description>Un modèle de code quasi frontière sous licence MIT a tout l&apos;air du signal qu&apos;il faut faire basculer votre choix par défaut, et cette lecture est fausse : la licence vous rend les…</description><pubDate>Fri, 26 Jun 2026 00:00:00 GMT</pubDate></item><item><title>Apprendre à un agent à oublier : élaguer l&apos;historique, pas la fenêtre</title><link>https://rachid-chabane.com/fr/blog/apprendre-a-un-agent-a-oublier/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/apprendre-a-un-agent-a-oublier/</guid><description>Quand un agent s&apos;enlise au milieu d&apos;une tâche longue, le réflexe est d&apos;agrandir la fenêtre de contexte. C&apos;est le mauvais levier : sur les tâches logicielles de longue haleine, la…</description><pubDate>Tue, 23 Jun 2026 00:00:00 GMT</pubDate></item><item><title>La température zéro n&apos;est pas déterministe, et le GPU n&apos;est pas en cause</title><link>https://rachid-chabane.com/fr/blog/la-temperature-zero-n-est-pas-deterministe/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/la-temperature-zero-n-est-pas-deterministe/</guid><description>Réglez un LLM sur la température 0, relancez mille fois la même requête, et vous n&apos;obtiendrez pas mille réponses identiques ; l&apos;excuse habituelle veut que l&apos;arithmétique…</description><pubDate>Mon, 22 Jun 2026 00:00:00 GMT</pubDate></item><item><title>Le score pass@1 de votre agent est aveugle à la fiabilité long-horizon</title><link>https://rachid-chabane.com/fr/blog/pass-at-1-ignore-la-fiabilite-long-horizon/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/pass-at-1-ignore-la-fiabilite-long-horizon/</guid><description>Sélectionner un agent autonome multi-étapes sur son score pass@1, c&apos;est optimiser le mauvais chiffre : capacité et fiabilité coïncident à l&apos;horizon un mais divergent dès que…</description><pubDate>Fri, 19 Jun 2026 00:00:00 GMT</pubDate></item><item><title>Le scaffold, pas le modèle, décide de votre score SWE-bench</title><link>https://rachid-chabane.com/fr/blog/scaffold-pas-modele-score-swe-bench/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/scaffold-pas-modele-score-swe-bench/</guid><description>On lit un score SWE-bench sur un classement et on le prend pour une propriété du modèle. Or, pour la comparaison qui guide vraiment un achat, choisir entre des modèles de codage…</description><pubDate>Thu, 18 Jun 2026 00:00:00 GMT</pubDate></item><item><title>L&apos;évaluation est le nouveau goulot d&apos;étranglement de calcul</title><link>https://rachid-chabane.com/fr/blog/l-evaluation-est-le-nouveau-goulot-de-calcul/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/l-evaluation-est-le-nouveau-goulot-de-calcul/</guid><description>La plupart des équipes budgètent leurs entraînements au dollar près et considèrent l&apos;évaluation comme à peu près gratuite. Un seul balayage d&apos;agents sur le Holistic Agent…</description><pubDate>Wed, 17 Jun 2026 00:00:00 GMT</pubDate></item><item><title>Les agents érodent le code qu&apos;ils continuent d&apos;éditer</title><link>https://rachid-chabane.com/fr/blog/les-agents-erodent-le-code-qu-ils-editent/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/les-agents-erodent-le-code-qu-ils-editent/</guid><description>Le pass@1 en un coup et la maintenabilité itérative ne mesurent pas la même chose, et sur l&apos;axe qui reflète le vrai travail logiciel, les meilleurs agents de code d&apos;aujourd&apos;hui…</description><pubDate>Tue, 16 Jun 2026 00:00:00 GMT</pubDate></item><item><title>Découper sur l&apos;arbre syntaxique, ou pas ? Ce que disent les benchmarks</title><link>https://rachid-chabane.com/fr/blog/decouper-sur-larbre-syntaxique/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/decouper-sur-larbre-syntaxique/</guid><description>Le découpage AST, sensible à la structure du code, aide le RAG de code, mais le chiffre vedette de cAST surestime ce que la règle de découpage apporte à elle seule. cAST annonce…</description><pubDate>Wed, 10 Jun 2026 00:00:00 GMT</pubDate></item><item><title>L&apos;IA a revalorisé tout le canon, elle ne l&apos;a pas aboli</title><link>https://rachid-chabane.com/fr/blog/l-ia-a-revalorise-le-canon/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/l-ia-a-revalorise-le-canon/</guid><description>Chaque convention dont j&apos;ai hérité pariait sur un seul coût : éditer du code qu&apos;un humain devait lire. Or un lecteur-machine et un auteur stochastique scindent désormais ce coût…</description><pubDate>Wed, 10 Jun 2026 00:00:00 GMT</pubDate></item><item><title>Votre fenêtre de contexte est un plafond, pas un budget</title><link>https://rachid-chabane.com/fr/blog/votre-fenetre-de-contexte-est-un-plafond/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/votre-fenetre-de-contexte-est-un-plafond/</guid><description>La longueur de contexte affichée sur la fiche technique d&apos;un modèle est un plafond marketing, pas un budget opérationnel ; je dimensionne donc un prompt pour ce que le modèle…</description><pubDate>Wed, 10 Jun 2026 00:00:00 GMT</pubDate></item><item><title>Orchestrer des agents de code avec des workflows déterministes</title><link>https://rachid-chabane.com/fr/blog/orchestrer-agents-code-deterministes/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/orchestrer-agents-code-deterministes/</guid><description>Découper une tâche d&apos;ingénierie en étapes vérifiables, et laisser l&apos;agent échouer tôt plutôt que tard.</description><pubDate>Sat, 30 May 2026 00:00:00 GMT</pubDate></item><item><title>RAG hybride : la fusion de rang réciproque en pratique</title><link>https://rachid-chabane.com/fr/blog/rag-hybride-fusion-rang-reciproque/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/rag-hybride-fusion-rang-reciproque/</guid><description>Combiner BM25 et vecteurs sans régler dix poids : le rang suffit.</description><pubDate>Wed, 27 May 2026 00:00:00 GMT</pubDate></item><item><title>Garde-fous de publication : un pipeline de fact-checking automatisé</title><link>https://rachid-chabane.com/fr/blog/garde-fous-publication-fact-checking/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/garde-fous-publication-fact-checking/</guid><description>Avant de publier, l’agent doit prouver ce qu’il avance, sources à l’appui.</description><pubDate>Sat, 23 May 2026 00:00:00 GMT</pubDate></item><item><title>Quantifier un modèle ouvert sans le casser</title><link>https://rachid-chabane.com/fr/blog/quantifier-modele-ouvert/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/quantifier-modele-ouvert/</guid><description>GPTQ, AWQ, GGUF : ce que la quantification coûte vraiment, mesuré.</description><pubDate>Tue, 19 May 2026 00:00:00 GMT</pubDate></item><item><title>Évaluer un agent outillé : au-delà du taux de réussite</title><link>https://rachid-chabane.com/fr/blog/evaluer-agent-outille/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/evaluer-agent-outille/</guid><description>Un agent qui mène la tâche à bien mais corrompt l’état n’a rien réussi du tout.</description><pubDate>Tue, 12 May 2026 00:00:00 GMT</pubDate></item><item><title>Servir un LLM open-source en production : le coût réel</title><link>https://rachid-chabane.com/fr/blog/servir-llm-open-source-production/</link><guid isPermaLink="true">https://rachid-chabane.com/fr/blog/servir-llm-open-source-production/</guid><description>vLLM, batching continu, cache KV : où part vraiment la VRAM.</description><pubDate>Mon, 04 May 2026 00:00:00 GMT</pubDate></item></channel></rss>