Claude Opus 5.5 contre GPT-6 Astra : Anthropic gagne le poste du créatif, OpenAI garde la souris
Par Jocelyn Bouget ·
Claude Opus 5.5 est sorti le 22/09/2026, dix-neuf jours après GPT-6 Astra, à un prix API 2,5 fois plus bas. Sur les index publiés, Opus 5.5 prend le poste du créatif web ; Astra garde le pilotage de l'ordinateur, en attendant le vrai match des apps de bureau.

Deux flagships en dix-neuf jours, et une seule question pour qui construit avec l'IA : lequel garder. Pour qui fabrique des sites, des visuels et des agents, les sources publiées tranchent en faveur de Claude Opus 5.5, pour le prix et pour le jugement visuel. GPT-6 Astra garde la main quand il faut piloter un ordinateur ou relire un texte. Le constat qui compte : le moins cher des deux est aussi celui qui affiche le plus haut score jamais relevé par Artificial Analysis.
La comparaison se fait sur les index publiés et deux tests tiers, pas sur un essai maison
Les deux camps : Claude Opus 5.5, publié par Anthropic le 22/09/2026, et GPT-6 Astra, sorti chez OpenAI le 03/09/2026 d'après DataCamp. Au 24/09/2026, je compare sur quatre types de pièces : les mesures indépendantes d'Artificial Analysis (relevés du 09/09/2026 et du 22/09/2026), le tableau d'Anthropic relayé par Vellum, les chiffres d'OpenAI relayés par DataCamp, et le test de sept jours d'Every, mené dans Claude Code et l'app de bureau Claude.
Une réserve de méthode d'entrée : les chiffres croisés entre éditeurs viennent de harnais et de niveaux d'effort différents. Artificial Analysis est la seule des sources à faire tourner les deux modèles sur les mêmes épreuves.
Six critères, les mêmes pour les deux camps
| Critère | Claude Opus 5.5 | GPT-6 Astra |
|---|---|---|
| Prix API par million de tokens | 4 $ en entrée, 20 $ en sortie, 0,20 $ en lecture de cache | 10 $ en entrée, 50 $ en sortie |
| Artificial Analysis Intelligence Index, effort max | 58 | 53 |
| Terminal-Bench 4.0, mesuré par Artificial Analysis | 59,6 %, à égalité avec Astra | 59 % |
| AutomationBench, tableaux des éditeurs | 40,0 % | 41,4 % |
| Pilotage d'ordinateur, OSWorld 2.0 | 81,8 % en score partiel, harnais différent | 72,6 %, environ 40 minutes par tâche |
| Tokens de sortie par tâche d'index, effort max | environ 119 000 | environ 27 000 |
Pour le web et le visuel, Opus 5.5 gagne sur le prix et sur le goût
Le premier argument tient en une ligne de facture. Anthropic a baissé Opus de 20 % et la lecture de cache de 60 %, quand Astra est vendu 2,5 fois plus cher que GPT-5.6 Sol. Concrètement, ça veut dire qu'un agent qui relit le même contexte en boucle, ce qui est le cas de tout agent de site ou de SaaS, paie sa lecture de cache 95 % moins cher que l'entrée pleine chez Anthropic.
Le deuxième argument est le jugement visuel, et c'est le plus rare dans un benchmark. Chez Every, le designer Tyler Nishida juge qu'Opus 5.5 suit les contraintes, les guides de style et un concept visuel « bien mieux qu'Astra, quel que soit le niveau d'effort ». Kieran Klaassen en fait son modèle du quotidien pour le code produit, et sa scène 3D à l'effort le plus haut bat celle de Fable 5.1. Deux anciens abonnés passés à Codex reviennent vers Claude.
Sur les épreuves d'agent, Artificial Analysis mesure Opus 5.5 à 59,6 % sur Terminal-Bench 4.0, au niveau d'Astra, et en tête du travail de connaissance avec 1 846 Elo sur GDPval-AA v2.1, là où Astra recule d'environ 45 Elo par rapport à Sol. Quatre des cinq niveaux d'effort d'Opus 5.5 sont sur la frontière intelligence contre coût par tâche. Ce qui est fort, c'est qu'Anthropic n'a pas eu à choisir entre la note et le prix.
Côté accès, Opus 5.5 est le modèle par défaut de l'app Claude, de Claude Code et de Cowork pour les offres Pro, Max et Team, et il est disponible sur AWS, Google Cloud et Microsoft Azure. Astra arrive d'abord chez un nombre limité d'organisations, puis chez les abonnés Plus, Pro, Business et Enterprise, désactivé par défaut côté Enterprise.
Là où Astra reprend la main : la souris, le clavier et la relecture
Astra est le modèle qui pilote un ordinateur. Sur OSWorld 2.0, il passe 72,6 % des tâches en environ 40 minutes, contre 75 minutes pour GPT-5.6 Sol, et il repère les éléments d'interface à l'écran à 92,7 % sur ScreenSpot-Pro. Pour un agent qui remplit un back-office ou fait la QA d'un front, c'est le score à regarder. Il pose une question ciblée seulement quand la réponse change le résultat, et dans Codex il garde des notes consultables d'une fenêtre de contexte à l'autre.
Astra est aussi le plus économe : environ 27 000 tokens de sortie par tâche d'index, contre 119 000 pour Opus 5.5. Ce point compte parce qu'Every a vu Opus 5.5 tourner une heure cinquante-deux sur une seule consigne et faire sauter des limites hebdomadaires pendant le test. Sur les tableaux des éditeurs, Astra garde une courte avance sur AutomationBench, 41,4 % contre 40,0 %, et une plus nette sur Terminal-Bench-Science, 64,6 % contre 58,7 %.
Enfin, la relecture. Dans les essais de Dan Shipper, Astra gagne sur les titres, les premières phrases et l'ordre des idées, et Kieran Klaassen le préfère encore pour l'écriture technique. Si votre usage est d'éditer plutôt que de dessiner, Astra reste le bon choix.
Reste un point que les sources ne tranchent pas : aucune ne compare les deux modèles dans leurs apps de bureau avec des serveurs MCP branchés, les chiffres croisés viennent de harnais différents, et Every précise qu'Anthropic lui a fourni un accès anticipé à Opus 5.5. Pour moi, le vrai test n'est pas l'API : c'est ChatGPT contre Claude Desktop, avec tous les MCP branchés. Ce match-là, personne ne l'a encore publié.
Pas encore testé de mon côté : cet article s'appuie sur les sources citées.
Vous voulez brancher ce genre d'outil sur votre site ou votre production ?
5 sources
- Artificial Analysis, Claude Opus 5.5 takes the top spot on the Artificial Analysis Intelligence Index, along with a 20% price cut and larger cache hit discount, 22/09/2026
- Artificial Analysis, Benchmarking GPT-6 Astra, 09/09/2026
- Every, Vibe Check: Opus 5.5 Is Pulling Our Codex Converts Back to Claude, 22/09/2026
- Vellum, Claude Opus 5.5 Benchmarks Explained, 22/09/2026
- DataCamp, GPT-6 Astra: Features, Benchmarks, Pricing, and How to Access It, 03/09/2026