Inside Sneakers
fr

GPT-6 Sol, Luna et Claude Opus 5.5 : la bataille de l’IA se déplace vers les prix

GPT-6 Sol, Luna et Claude Opus 5.5 : la bataille de l’IA se déplace vers les prix
Image générée avec l’IA

Description

OpenAI et Anthropic ont dévoilé presque simultanément trois nouveaux modèles qui illustrent une nouvelle phase de leur rivalité. GPT-6 Sol et Luna réduisent fortement le coût d’accès à la famille GPT-6, tandis que Claude Opus 5.5 rapproche les performances du haut de gamme d’Anthropic d’un tarif plus accessible. Derrière les benchmarks, la compétition se joue désormais de plus en plus sur la quantité de travail réellement accomplie pour chaque dollar dépensé.

Le contexte des lancements : Une tendance au coût maîtrisé

Les annonces des deux géants ont eu lieu le 22 septembre, avec un intervalle d'environ quatre-vingt-dix minutes. Anthropic a commencé par présenter Claude Opus 5.5, suivi par OpenAI qui a élargi sa gamme GPT-6 avec Sol et Luna. Bien que ces trois modèles ne ciblent pas exactement les mêmes usages, la convergence de leurs lancements met en lumière une tendance commune : offrir des capacités accrues à un coût d'exploitation nettement inférieur.

Positionnement technique et économique des modèles

OpenAI a défini plusieurs rôles au sein de sa nouvelle famille.

  • GPT-6 Sol est destiné aux tâches professionnelles complexes, au développement logiciel, aux agents et aux opérations nécessitant l’utilisation d’un ordinateur.
  • GPT-6 Luna privilégie la vitesse, les volumes importants et les opérations plus ciblées.
  • GPT-6 Astra conserve son rôle de modèle le plus capable pour les tâches les plus exigeantes.

Reuters rapporte qu'OpenAI attribue une partie de cette baisse de prix aux progrès réalisés dans son infrastructure de cache et d’inférence, un facteur qui impacte directement le coût total d'utilisation.

La comparaison des coûts est frappante :

  • GPT-6 Sol coûte 2 dollars par million de tokens en entrée et 10 dollars en sortie.
  • GPT-6 Luna atteint des tarifs nettement inférieurs, à 0,10 dollar en entrée et 0,50 dollar en sortie.

Ces tarifications représentent selon OpenAI une réduction de 50 % par rapport aux prix promotionnels de la génération GPT-5.6. En plus de cela, les données officielles de l’API ajoutent un coût de 0,20 dollar par million de tokens mis en cache pour Sol et seulement 0,01 dollar pour Luna.

Anthropic suit une stratégie similaire avec Claude Opus 5.5, ciblant toutefois un segment plus élevé. Ce modèle est facturé 4 dollars par million de tokens en entrée et 20 dollars en sortie (contre 5 et 25 dollars pour Opus 5). Anthropic estime néanmoins que l’économie réelle atteint environ 40 % sur les charges de travail habituelles, car Opus 5.5 tend également à nécessiter moins de tokens pour accomplir certaines tâches spécifiques.

L'efficacité des performances au-delà du benchmark

La baisse des coûts est étroitement liée à des progrès revendiqués en termes de performances. Anthropic positionne Claude Opus 5.5 comme capable d’atteindre le niveau de Claude Fable 5.1 sur la plupart des tâches, tout en surpassant ce modèle sur plusieurs évaluations agentiques. Sur Terminal-Bench 4.0, par exemple, Anthropic annonce un score de 66,4 %, contre 55,8 % pour Fable 5.1 et 52,3 % pour Opus 5. Il est important de noter que ces résultats proviennent des évaluations publiées par Anthropic et ne constituent pas un comparatif indépendant avec les nouveaux modèles d’OpenAI.

VentureBeat souligne la difficulté de déterminer un vainqueur exclusif à partir des seuls benchmarks disponibles, car les deux entreprises n'ont publié aucune comparaison directe entre GPT-6 Sol et Claude Opus 5.5 utilisant les mêmes paramètres ou le même environnement d’évaluation.

Les résultats disponibles indiquent qu'Opus 5.5 maintient un positionnement ambitieux sur les tâches agentiques complexes. En revanche, GPT-6 Sol propose un prix brut deux fois inférieur (4 dollars contre 2 dollars ; 20 dollars contre 10 dollars).

L’architecture de la gamme OpenAI devient plus nuancée avec l'intégration de Luna. À seulement 0,10 dollar par million de tokens en entrée et 0,50 dollar en sortie, ce modèle ne rivalise pas directement avec Opus 5.5, mais vise plutôt les tâches répétitives et les volumes importants où le coût est primordial. OpenAI propose ainsi une hiérarchie claire : Astra pour les problèmes difficiles ; Sol pour les tâches complexes répétées ; Luna pour l'efficacité coût/volume.

Anthropic met quant à lui l’accent sur l’efficacité des agents opérant sur de longues périodes. L’entreprise cite notamment un cas de migration de 680 000 lignes de code réalisée en moins d’une journée par un utilisateur précoce. D'autres essais rapportés témoignent de réductions du nombre d’étapes, du temps d’exécution ou des tokens nécessaires. Ces exemples sont cependant basés sur les données d'Anthropic et de ses partenaires sélectionnés pour les tests initiaux, nécessitant des évaluations indépendantes pour confirmer leur généralité.

Sécurité, alignement et positionnement stratégique

La sécurité demeure un axe majeur du positionnement de Claude Opus 5.5. Anthropic a fait évaluer ce modèle par des organismes externes tels que METR et Frontier Design. L’entreprise affirme qu'Opus 5.5 obtient ses meilleurs résultats à ce jour suite à un audit comportemental automatisé couvrant près de 2 000 scénarios, signalant une réduction d'environ 85 % des tentatives de franchissement des limites de confinement par rapport aux versions précédentes (Opus 5 et Mythos 5.1).

D’un point de vue parallèle, OpenAI affirme que Sol et Luna bénéficient de progrès liés à Astra concernant le raisonnement, la fiabilité factuelle, l'utilisation de code, l'interaction avec l’ordinateur et l’alignement général.

Ces annonces interviennent également dans un contexte macro pour Anthropic. Claude Opus 5.5 est le premier modèle publié depuis l’appel de Dario Amodei visant à modérer collectivement le rythme des systèmes les plus avancés. Anthropic précise que cette prudence ne signifie pas un arrêt du développement, mais la recherche d'un rythme qui permette aux travaux sur la sécurité de suivre l'évolution des capacités techniques.

Conclusion : Vers une bataille de l'efficience totale

La rivalité entre OpenAI et Anthropic a ainsi cessé d’être uniquement axée sur la quête du meilleur score benchmark. Avec GPT-6 Sol, Luna et Claude Opus 5.5, les deux entreprises placent désormais au centre de leur communication l'efficacité économique : le coût des tokens, l’utilisation du cache, le nombre d’étapes requis, le taux de réussite global et, surtout, la quantité totale de travail accompli.

Pour les organisations déployant des agents à grande échelle, le véritable comparatif pourrait se déplacer du prix affiché pour un million de tokens vers le coût total nécessaire pour achever correctement une tâche complexe.

D’autres contenus susceptibles de vous intéresser.

D’autres contenus susceptibles de vous intéresser.

D’autres contenus susceptibles de vous intéresser.