rachid chabane.
Rechercher
Veille

Radar

Ce qui vient de sortir en ingénierie de l’IA : specs, modèles, outils. Brèves datées, sourcées, avec schéma, code et impact pour une équipe.

33 brèves · du plus récent
31-07-2026 Outil

Cursor Router choisit le modèle à chaque requête et optimise la satisfaction utilisateur

Cursor a lancé Cursor Router le 22 juillet 2026, un classifieur qui examine chaque requête avant qu'un modèle ne tourne et l'oriente vers le modèle le mieux adapté, entraîné sur plus de 600k requêtes réelles et optimisé sur la satisfaction utilisateur (AFC) comme récompense. Cursor annonce 60% d'économie sur son propre A/B test en ligne. Il nomme aussi une seconde métrique de qualité, le keep rate, sans en publier de chiffre.

Cursoragentscoding
30-07-2026 Outil

NVIDIA emmène son cadre d'exécution d'agents dans une nouvelle alliance de sécurité, où les docstrings tiennent lieu de prompts

NVIDIA a annoncé l'Open Secure AI Alliance le 27 juillet 2026 et cite parmi ses contributions ses travaux sur les cadres d'exécution d'agents. Ces travaux, c'est NOOA, un framework sous licence Apache 2.0 où une docstring tient lieu de prompt. Son article a été déposé sur arXiv le 22 juillet 2026 : il précède donc l'alliance de cinq jours.

NVIDIANOOAagentssecurity
27-07-2026 Sécurité

Une page web piégée a réécrit la configuration MCP de Kiro et exécuté du code sans passer par l'autorisation

Kodem Security et Intezer ont divulgué le 19 juillet 2026 une chaîne d'injection de prompt dans Kiro, l'IDE agentique d'AWS : une page web récupérée pousse l'agent à écrire le serveur d'un attaquant dans ~/.kiro/settings/mcp.json, que Kiro recharge et démarre. Selon la chronologie de Kodem, AWS a corrigé le 3 avril 2026 et Amazon a attribué CVE-2026-10591 le 22 juillet ; l'actualité, c'est donc la chaîne publiée et la leçon sur les écritures d'agent qui méritent un garde-fou.

KiroAWSMCPprompt injectionagent security
25-07-2026 Sortie

Claude Opus 5 arrive au tarif Opus inchangé, avec le réglage d'effort comme levier de coût

Anthropic a publié Claude Opus 5 le 24 juillet 2026 à 5 $ par million de tokens en entrée et 25 $ par million en sortie, soit le tarif d'Opus 4.8. La décision de coût se joue désormais sur le réglage d'effort défini requête par requête, et le banc de revue de CodeRabbit montre que l'augmenter se paie en rappel et en tokens.

ClaudeClaude Opus 5Anthropicagentic codingeffort
22-07-2026 Sortie

Le meilleur détecteur de failles V8 de Google est un modèle inaccessible aux développeurs

Gemini 3.5 Flash Cyber a remonté 55 problèmes uniques confirmés sur le moteur V8, contre 47 pour sa version courante et 36 pour Claude Opus 4.6, avant d'être réservé aux gouvernements et partenaires de confiance via CodeMender. L'écart décisif est 55 contre 47: la barrière tient à la recette d'entraînement, pas aux poids.

GeminiCodeMendersecurityagentsevals
21-07-2026 Évolution de spec

Le rôle système de Claude arrive sur trois modèles, et deux docs éditeurs se contredisent

L'entrée de notes de version du 2026-07-15 documente les messages système en cours de conversation sur Claude Fable 5, Claude Mythos 5 et Claude Opus 4.8, sans en-tête bêta, tandis que la page Bedrock, consultée le 2026-07-21, annonce toujours Opus 4.8 uniquement : conditionnez la fonctionnalité à un drapeau de capacité, pas à une liste de modèles figée.

ClaudeAnthropic APIprompt-cachingagents
19-07-2026 Sortie

Thinking Machines ouvre les poids d'Inkling sous Apache 2.0, et garde Tinker

Le 15 juillet 2026, Thinking Machines Lab a publié Inkling sous Apache 2.0 : 975 milliards de paramètres, 41 milliards actifs, poids disponibles le jour même. Le laboratoire concède que le modèle n'est pas le meilleur du marché, et garde Tinker, la boucle d'affinage, pour lui.

Thinking MachinesInklingTinkeropen-weightagents
18-07-2026 Sortie

OpenAI déplace l'orchestration multi-agents côté serveur, avec un fan-out par défaut de 3

Le 9 juillet 2026, OpenAI a livré l'orchestration multi-agents en beta dans son API Responses, hébergeant l'arbre de sous-agents côté serveur derrière un seul champ. Le signal, c'est le frein : max_concurrent_subagents vaut 3 par défaut, un fan-out étroit là où la lignée Claude Code en pousse des centaines.

OpenAIGPT-5.6Responses APIagentsorchestration
15-07-2026 Sécurité

L'IDOR de Langflow entre au catalogue KEV de la CISA, et votre seuil CVSS l'aurait ignorée

La CISA a inscrit CVE-2026-55255 au KEV le 7 juillet 2026 : un IDOR entre locataires dans Langflow, exploité depuis le 25 juin pour extraire les clés LLM et cloud embarquées dans les flows des autres. La même faille est notée 9.9 par l'éditeur, 8.4 par le NVD et 6.1 par The Hacker News, donc tout seuil CVSS l'aurait laissée passer.

LangflowCISA KEVagentssecurity
13-07-2026 Sortie

Claude Code Desktop ajoute un navigateur intégré, et sépare la navigation agentique selon qui détient les cookies

En semaine 28 (du 6 au 10 juillet 2026), Claude Code sur ordinateur a reçu un navigateur intégré, doté d'un profil isolé et vierge sans aucune connexion enregistrée. Le vrai changement, c'est la séparation : vous disposez désormais de deux surfaces de navigation, et vous choisissez selon que l'agent doit voir votre identité authentifiée ou non.

ClaudeClaude Codeagentsbrowser-use
11-07-2026 Sortie

DeepSeek ajoute une tarification aux heures de pointe à son API V4, et l'heure devient une dimension de routage

Le 2026-06-30, DeepSeek a prévenu les abonnés de son API que la V4 passera à une tarification heures pleines / heures creuses lors de la disponibilité générale de la mi-juillet : les appels dans deux créneaux quotidiens (heure de Pékin) sont facturés au double. Le vrai changement, c'est que l'heure de la journée devient une dimension de routage que votre passerelle doit intégrer.

DeepSeekDeepSeek-V4inferencepricingrouting
05-07-2026 Outil

Claude Science industrialise le motif d'agents coordinateur plus réviseur

Anthropic a lancé Claude Science le 2026-06-30, un atelier d'IA en bêta pour les scientifiques, sur macOS et Linux et réservé aux formules payantes. Ce n'est pas un nouveau modèle : il s'appuie sur les mêmes modèles Claude, dont Opus 4.8. L'idée transférable : un coordinateur qui crée des sous-agents et un agent réviseur distinct qui signale chaque nombre qu'il ne peut tracer, avec une provenance fournie par défaut.

ClaudeAnthropicagentsNVIDIA
04-07-2026 Sortie

L'API Interactions de Gemini passe en disponibilité générale et devient le choix par défaut

Le 2026-06-22, Google a fait passer son API Interactions en disponibilité générale et en a fait la voie principale, par défaut, pour construire sur les modèles et les agents Gemini ; l'API generateContent reste prise en charge, mais les nouvelles capacités agentiques devraient atterrir exclusivement sur l'API Interactions.

GeminiGoogleagentsAPI
03-07-2026 Outil

Le premier modèle à poids ouverts de GitHub Copilot : Kimi K2.7 Code

GitHub a rendu Kimi K2.7 Code généralement disponible dans Copilot le 2026-07-01 : premier modèle à poids ouverts du sélecteur, hébergé sur Azure et facturé à l'usage, et les mêmes poids que vous pouvez auto-héberger sous une Modified MIT License.

KimiGitHub CopilotMoonshotopen-weightcoding
23-06-2026 Sortie

DiffusionGemma 26B-A4B : le premier modèle ouvert de Google à diffusion de texte

Le 2026-06-10, Google DeepMind a publié DiffusionGemma 26B-A4B, un MoE à poids ouverts (25,2 G au total / 3,8 G actifs) bâti sur le squelette Gemma 4, qui troque le décodage autoregressif contre une diffusion de texte discrète : il débruite en parallèle un canevas de 256 tokens à plus de 1000 tokens/s sur un seul H100. La vitesse se paie en qualité : 77,6 % sur MMLU Pro contre 82,6 % pour Gemma 4. Le tout sous licence Apache 2.0.

open-weightllm-releasetext-diffusioninferencelong-context
22-06-2026 Outil

GitHub Spec Kit : piloter un agent par des specs Markdown

Spec Kit, la boîte à outils MIT de GitHub pour le développement piloté par spécification, est arrivée en v0.11.3 avec des commandes désormais préfixées /speckit.* et plus de 30 agents pris en charge.

agentsosstooling
22-06-2026 Sortie

GLM-5.2 : un MoE de codage 753B, contexte 1M, sous licence MIT

Z.ai a livre GLM-5.2, un modele de codage Mixture-of-Experts de 753B avec un contexte d'1M de tokens et des poids ouverts sous MIT, associant l'attention parcimonieuse IndexShare a une couche MTP amelioree pour le decodage speculatif.

ossinferencelong-contextagentsevaluation
22-06-2026 Sortie

MiniMax-M3 : un MoE multimodal en poids ouverts, contexte 1M sur attention creuse

MiniMax a publié M3 le 1er juin 2026 : un MoE en poids ouverts (~428 Md / ~23 Md actifs) qui associe un contexte d'un million de tokens à une entrée native texte, image et vidéo et un nouvel opérateur d'attention creuse (MSA), avec 59,0 % sur SWE-Bench Pro.

open-weightllm-releaselong-contextmultimodalsparse-attention