Claude Opus 4.8 a été lancé avec fracas : programmation et missions d'Agent dépassent largement GPT-5.5

Anthropic a officiellement lancé Claude Opus 4.8, réalisant d'importantes avancées dans la programmation, les tâches d'Agent et le travail d'expertise. La nouvelle version prend en charge l'ajustement contrôlable de l'effort par l'utilisateur, la fonctionnalité de flux de travail dynamique de Claude Code, une augmentation de la vitesse en mode rapide de 2,5 fois et une réduction des prix de 3 fois.

Dans les tests de référence Super-Agent, Opus 4.8 est le seul modèle à avoir terminé chaque cas de bout en bout, surpassant largement GPT-5.5. Il a établi des scores historiques dans plusieurs évaluations professionnelles telles que CursorBench et Legal Agent Benchmark. Les testeurs précoces ont décrit son « jugement considérablement amélioré », « appels d'outils plus efficaces », et « honnêteté considérablement améliorée ».

Pourquoi c'est important : cela marque une nouvelle étape pour l'IA dans le domaine de la programmation d'Agent et du travail d'expertise, ce qui améliorera directement la productivité des développeurs et la qualité des applications IA en entreprise.

#Claude #AI #人工智能 #Anthropic #grand modèle