Le 12 septembre, Dario Amodei publiait un essai dans lequel il exhortait les laboratoires d’intelligence artificielle à modérer le rythme de leurs progrès. Dix jours plus tard, sa propre entreprise Anthropic dévoilait Claude Opus 5.5. Quatre-vingt-dix minutes plus tard, OpenAI ripostait avec GPT-6 Sol et GPT-6 Luna. L’industrie ne ralentit pas. Elle accélère.
Cette quasi-simultanéité n’est pas un hasard. Elle révèle une veille concurrentielle menée en temps réel où aucun acteur ne veut laisser l’autre occuper seul l’espace médiatique. Depuis mars 2023, date des lancements concomitants de GPT-4 et du premier Claude, les deux groupes ne s’étaient plus répondus du tac au tac avec une telle précision. L’été dernier, Anthropic revendiquait encore un test écrasant face à OpenAI, qui avait repris la main en ajustant deux paramètres.
Claude Opus 5.5 s’annonce comme le premier modèle d’une nouvelle famille « Claude 5.5 ». Anthropic le positionne au niveau de son haut de gamme Fable 5.1 sur la plupart des tâches, pour un coût annoncé en baisse de 40 % par rapport à Opus 5. Le prix du million de tokens en sortie passe de 25 à 20 dollars. L’entrée coûte désormais 4 dollars contre 5 précédemment. L’entreprise précise que l’économie réelle sur des charges de travail typiques atteint 40 % grâce à une consommation de tokens plus sobre et à une lecture de cache divisée par cinq.
Côté performances, Opus 5.5 obtient 66,4 % sur Terminal-Bench 4.0, contre 57,9 % pour GPT-6 Astra et 55,8 % pour Fable 5.1. Sur GDPval-AA, qui évalue des tâches professionnelles dans 44 métiers, il culmine à 1 846 points Elo. GPT-6 Astra conserve l’avantage sur l’automatisation de tâches en entreprise et la recherche scientifique. Anthropic reconnaît toutefois que l’écart réel entre Opus 5.5 et Fable 5.1 est plus faible que ne le suggèrent les chiffres.
Opus 5.5 inaugure aussi un marquage de ses contenus, une première pour la gamme Opus. Les garde-fous de Fable 5.1 sont repris : les requêtes de cybersécurité sont redirigées vers Opus 4.8, celles de biologie vers Opus 5. Le sélecteur d’effort est désormais réglé sur « Moyen » par défaut, et le mode réflexion ne peut plus être désactivé.
OpenAI, de son côté, présente GPT-6 Sol et Luna comme des déclinaisons allégées de GPT-6 Astra. Sol vise le code complexe et les agents autonomes à 2 dollars le million de tokens en entrée, 10 en sortie. Luna, à 0,10 dollar l’entrée et 0,50 dollar la sortie, s’attaque au segment des modèles open source et de l’IA locale. À ce tarif, seules les entreprises en quête de confidentialité ont encore intérêt à héberger leurs propres modèles.
La baisse des coûts devient le nouveau terrain d’affrontement. Pendant des mois, chaque annonce se jouait sur les scores de puissance. OpenAI déplace le curseur sur le prix d’usage, celui que paient réellement les développeurs et les entreprises qui intègrent ces modèles dans leurs produits. Anthropic suit la même logique. Pour les clients, la nouvelle est bonne. Sur la promesse de lever le pied, en revanche, il faudra repasser.
Sources : Numerama, Frandroid, Les Numériques, Clubic
Votre spécialiste du génie logiciel dispose d’une équipe aguerrie dans la réalisation de projets informatiques. Pour réussir votre transformation digitale, nous sommes votre partenaire informatique de taille.