Atteint l’Arena : le Claude Opus 5.5 d’Anthropic est sorti depuis à peine quelques jours et s’est déjà hissé à la première place du classement général de Text Arena — environ 1509 points (±12), une avance construite grâce à des points de préférence accumulés par votes en tête-à-tête réalisés en aveugle par des humains. Dans le top 10, Anthropic occupe la majorité des places.
Cette version est sortie le 22 septembre : l’entrée coûte environ 4 dollars par million de tokens et la sortie environ 20 dollars, soit environ 20 % moins cher que la génération précédente Opus 5 ; la fenêtre de contexte atteint 1 million de tokens. Côté références, Terminal-Bench tourne autour de 66,4 % et CursorBench autour de 57,8 %.
Sur Arena, ils ont aussi découpé le style d’écriture : les tirets — d’environ 15,2 pour mille mots — sont tombés à 0,8 (soit environ 95 % de moins), les points-virgules ont aussi été nettement réduits, et les phrases sont plus courtes — mais, paradoxalement, la réponse unique devient un peu plus verbeuse (environ 453 → 481 mots). Le premier de liste change assez vite : il faut le noter.
#AI #Anthropic #Claude
Cette version est sortie le 22 septembre : l’entrée coûte environ 4 dollars par million de tokens et la sortie environ 20 dollars, soit environ 20 % moins cher que la génération précédente Opus 5 ; la fenêtre de contexte atteint 1 million de tokens. Côté références, Terminal-Bench tourne autour de 66,4 % et CursorBench autour de 57,8 %.
Sur Arena, ils ont aussi découpé le style d’écriture : les tirets — d’environ 15,2 pour mille mots — sont tombés à 0,8 (soit environ 95 % de moins), les points-virgules ont aussi été nettement réduits, et les phrases sont plus courtes — mais, paradoxalement, la réponse unique devient un peu plus verbeuse (environ 453 → 481 mots). Le premier de liste change assez vite : il faut le noter.
#AI #Anthropic #Claude
