Des runners plus rapides ne suffisent pas face à la CI des agents
À mon sens, des runners plus rapides ne suffisent pas face à la charge de CI des agents de code : chaque test coûte moins cher, mais les agents multiplient exécutions et revues.…
À mon sens, des runners plus rapides ne suffisent pas face à la charge de CI des agents de code : chaque test coûte moins cher, mais les agents multiplient exécutions et revues.…
Je ne cite pas un taux de qualité des correctifs tant que je ne sais pas si l'évaluateur qui l'a produit donnerait deux fois le même verdict au même correctif. La pédanterie…
Une allowlist de sortie qui filtre sur le verbe HTTP ne borne rien, car c'est l'extrémité distante qui décide si une requête est une lecture ou une écriture. Un essaim autorisé à…
L'essentiel du budget sécurité achète un ordre de passage dans une file qui ne se vide pas, et l'heure marginale rapporte davantage investie dans le débit de remédiation. La note…
À mon sens, une migration à l'échelle du dépôt est décidée par l'instrument qui la note : une note comportementale ne voit pas une migration absente. Ce n'est pas un jugement sur…
À mon sens, la variable de conception d'un harnais de code tient à ce que dit la trace d'échec, et mes deux réflexes y écrivent le mauvais texte. Le premier consiste à consigner…
Le filigrane est fait de la liberté du sampler [s17], et chaque pratique qui rend mon agent de code fiable dépense cette même liberté. Anthropic énonce le mécanisme sans détour :…
Si vous rédigez une politique LLM pour votre dépôt, c'est la prémisse retenue qui décide de l'endroit où la règle fuira. Trois projets de chaîne d'outils viennent de publier la…
Les intervenants de Hugging Face n'ont pas pu analyser leur propre incident via les API commerciales, donc le comportement de refus ne figure plus dans mes jeux de contrôles. La…
Il n'existe aucun chiffre de productivité transposable pour les agents de code : dans cet état des preuves, l'instrument pèse plus lourd que l'outil, et le choix du proxy décide…
Quatre-vingt-quatorze pour cent des responsables jugent le code produit par IA de meilleure qualité que le code écrit par des humains au moment de la revue, et pourtant 82 %…
Réglez un LLM sur la température 0, relancez mille fois la même requête, et vous n'obtiendrez pas mille réponses identiques ; l'excuse habituelle veut que l'arithmétique…
Chaque convention dont j'ai hérité pariait sur un seul coût : éditer du code qu'un humain devait lire. Or un lecteur-machine et un auteur stochastique scindent désormais ce coût…
Avant de publier, l’agent doit prouver ce qu’il avance, sources à l’appui.
Une erreur est survenue. Réessayez.
L’assistant est temporairement indisponible. Retour prévu le {date}.
Une question sur Rachid ou sur ce site ? Demandez-moi.