Ce qui change
OpenAI a publié GPT-6 Sol et GPT-6 Luna le 22 septembre 2026 23, exposés dans l’API sous les identifiants gpt-6-sol et gpt-6-luna 1. OpenAI annonce une baisse de 50 % par rapport aux tarifs promotionnels de GPT-5.6 : Sol passe de 4 $ à 2 $ par million de jetons en entrée et de 20 $ à 10 $ en sortie, Luna de 0,20 $ à 0,10 $ et de 1,20 $ à 0,50 $ 1. Artificial Analysis les place tous deux au niveau de GPT-5.6 sur son Intelligence Index, avec des progrès sur certaines évaluations et des reculs sur d’autres 2.
Où Sol et Luna divergent
| GPT-6 face à GPT-5.6 (Artificial Analysis) | Sol | Luna |
|---|---|---|
| Coding Agent Index, max 2 | 57 (+2) | 41 (-2) |
| SWE-Atlas-QnA, max 2 | 58 % contre 54 % | 44 % contre 49 % |
| AutomationBench-AA 2 | 62 % contre 60 % | 53 % contre 50 % |
| Coût par tâche de l’Intelligence Index, max 2 | 1,06 $ contre 1,99 $ | 0,07 $ contre 0,18 $ |
Pour les agents de code, Sol en max est la mise à niveau évidente. Dans le harness Codex d’OpenAI, il obtient 57 sur le Coding Agent Index, soit 2 points de plus, pour 2,99 $ par tâche sur cet index, environ 50 % de moins que GPT-5.6 Sol en max 2.
Luna, lui, relève du routage. OpenAI annonce qu’en effort high il fait 5,4 points de pourcentage de mieux que son prédécesseur sur AutomationBench 1. Artificial Analysis mesure aussi un gain sur son propre AutomationBench-AA 2. En code, il recule : en max, 41 sur le Coding Agent Index, 2 points sous GPT-5.6 Luna en max, avec des scores plus bas sur SWE-Atlas-QnA et DeepSWE v1.1 2. Sur l’Intelligence Index, sa baisse de coût par tâche vient de la baisse de prix : en max, il consomme plus de jetons de sortie par tâche que GPT-5.6 Luna, 51k contre 41k 2.
Les deux modèles régressent sur GDPval-AA v2.1 en effort max, ce qu’Artificial Analysis attribue à des livrables plus courts qui omettent plus souvent des éléments requis 2. Je pense que c’est le mode de défaillance à tester avant toute bascule : un générateur de rapports ou de spécifications qui passe une relecture rapide et livre un document amputé d’une section obligatoire.
Impact pour une équipe
Simon Willison signale une hausse de prix de 25 % programmée pour GPT-5.6 en novembre 3. À mon avis, cela tranche la question de Luna pour les agents de code : garder GPT-5.6 Luna pour éviter le recul de 2 points coûte déjà plus cher par tâche en max, et coûtera davantage encore après novembre. Reste un arbitrage entre la facture plus basse de Luna et le meilleur score de Sol sur le Coding Agent Index en max.
Ma recommandation : basculez dès maintenant sur gpt-6-sol les agents de code qui tournent sur GPT-5.6 Sol. Orientez gpt-6-luna en priorité vers l’automatisation de workflows et les outils de requêtes. Willison a passé sa démo Datasette Agent sur GPT-6 Luna et écrit qu’il semble rapide et compétent en requêtes SQL 3. Pour les tâches qui produisent des livrables, ajoutez une évaluation qui vérifie la présence de chaque élément requis avant de confier le travail à Luna ou à Sol, et bouclez-la avant novembre.