Claude Opus 5.5 заработал в составе Perplexity Computer во вторник как новый стандартный уровень усилий на платформе; при этом сама Perplexity разместила показатели бенчмарков в аккаунте в течение минут после переключения.

Ключевые выводы

  • Claude Opus 5.5 стал новым стандартным уровнем усилий в линейке Perplexity Computer во вторник

  • Модель набрала 0.610 на бенчмарке WANDR от Perplexity при стоимости 4.13 доллара за задачу

  • Арав Шринивас заявил, что Opus 5.5 станет вариантом по умолчанию для всех пользователей Perplexity Computer

  • Perplexity Computer — это продукт для браузерных AI-агентов, который выполняет многошаговые задачи, включая исследования и покупки

Модель набрала 0,610 на внутреннем бенчмарке WANDR от Perplexity — широком и глубоком исследовательском тесте, при стоимости 4,13 доллара за задачу, и опубликовала, что результат «незначительно» обошел конкурирующую модель Fable 5.1. Perplexity Computer — это браузерный продукт компании с ИИ-агентом, который выполняет многоэтапные задачи, такие как исследования и покупки, от имени пользователя, а не просто отвечает на запросы в чате.

Генеральный директор Perplexity Арав Сринивас также опубликовал свой пост, подтверждающий развертывание для всех пользователей Perplexity Computer, сделав акцент на экономической эффективности, а не на «сыром» счете.

Он сказал, что Opus 5.5 «сравнимо хорошо» с Fable 5.1 «при небольшой доле стоимости», и в дальнейшем станет вариантом по умолчанию.

Третий аккаунт, аналитический канал с отслеживанием ИИ TestingCatalog, независимо отметил релиз как новый уровень в агентском кодинге и задачах с использованием компьютера, описав это как момент «экспоненциального замедления» — отсылку к тому, что выигрыши от последующих релизов на переднем крае становятся все уже.

Почему стоимость за задачу становится новым табло результатов

Раньше релизы моделей конкурировали исключительно по оценке на бенчмарках. Запуск Claude Opus 5.5 знаменует сдвиг в сторону сравнений, нормализованных по стоимости: для компаний, которые запускают агентов в масштабе, показатель «долларов за задачу» будет значить столько же, сколько и сырая точность.

Бенчмарк WANDR от Perplexity измеряет, насколько хорошо модель справляется с открытыми исследовательскими задачами, требующими нескольких шагов поиска и рассуждений, а не с одноразовыми вопросами и ответами.

Цена 4,13 доллара за задачу важна только при больших объемах — а именно к таким масштабам начинают приходить развертывания корпоративных ИИ-агентов.

От чат-помощника к платной агентной платформе

Anthropic построила свою репутацию на чат-боте Claude, прежде чем выйти в корпоративные агентные рабочие процессы к 2026 году, включая интеграции по безопасности с такими компаниями, как подразделение Unit 42 в Palo Alto Networks, которое начало сочетать модели Claude с непрерывными инструментами защиты от угроз.

Релиз Opus 5.5 продолжает этот шаг в сторонний продукт для потребителей, а не в собственный интерфейс Anthropic — ход в дистрибуции, который перекликается с тем, как OpenAI разместила GPT-6 Astra в партнерских инструментах, таких как видеогенератор Higgsfield AI.

Также читайте: Claude от Anthropic для финансовых консультантов проходит первое настоящее испытание со Schwab и BlackRock Data

Что происходит, когда выигрыши на фронтире начинают сокращаться

Формулировка TestingCatalog указывает на живые дебаты среди ИИ-лабораторий о том, действительно ли последующие поколения моделей дают меньшие приросты, даже если затраты падают быстрее. Если преимущество Opus 5.5 над Fable 5.1 окажется несущественным по баллам, но решающим по цене, покупатели могут начать выбирать модели по кривым стоимости, а не по месту в рейтинге.

Это изменит то, как лаборатории продают релизы, и то, насколько быстро конкуренты отвечают собственными снижениями цен.

Читайте дальше: Корпоративный рывок ИИ получает официальную сделку Anthropic в Societe Generale