В понедельник Anthropic сделала Claude Sonnet 5.5 моделью по умолчанию во всех приложениях и API Claude, сделав ставку на более низкую стоимость и производительность, близкую к Opus.
Ключевые выводы
В понедельник Anthropic сделала Claude Sonnet 5.5 моделью по умолчанию во всех приложениях и API Claude
Anthropic заявляет, что Claude Sonnet 5.5 работает на 30% быстрее и стоит на 30% дешевле по сравнению с предшественником
Sonnet выступала в качестве модели среднего уровня для Anthropic с момента выхода оригинальной линейки Claude 3
Anthropic не указала доступность по регионам, изменения в тарифных планах или ограничения на частоту запросов в API
Anthropic заявляет, что новая модель работает на 30% быстрее и на 30% дешевле по сравнению с предшественником, приближаясь при этом к модели Opus 5.5 высшего уровня. Запуск, судя по всему, произошёл одновременно в потребительском интерфейсе Claude и в developer API, что соответствует схеме распространения Anthropic для предыдущих релизов Sonnet. Также читайте: Билл Гейтс предупреждает о риске миллиардных смертей от ИИ, призывает к надзору со стороны правительства
С момента выхода исходной линейки Claude 3 Sonnet была моделью среднего уровня Anthropic: по «сырой» вычислительной мощности она находится ниже Opus, но оценена так, чтобы быть подходящей для коммерческого использования с более высокой интенсивностью.
Подача компании заключается в том, что Claude Sonnet 5.5 сужает компромисс между качеством выдачи и стоимостью одного запроса, но в предоставленном анонсе не указана региональная доступность, изменения в подписочных тарифах или лимиты на частоту запросов к API.
Восхождение Claude Sonnet к производительности уровня фронтира
С 2024 года Anthropic дорабатывает Sonnet примерно каждые несколько месяцев: каждый релиз сокращает разрыв по производительности по сравнению с Opus, одновременно снижая цену. Такой ритм отражает более широкий сдвиг в сторону корпоративных клиентов, выполняющих миллионы вызовов API в день: 30% снижение стоимости напрямую превращается в рост маржи.
OpenAI и Google проводили похожие стратегии среднего уровня с вариантами GPT и Gemini, конкурируя как по стоимости за токен, так и по результатам бенчмарков.
Для клиентов сейчас к поставке относится новый стандарт в потребительском интерфейсе Claude и в API. Anthropic не уточняла, отличается ли доступ в зависимости от региона, тарифного плана или лимита на использование API.
ИИ-агенты могут автономно выполнять многошаговые задачи, а не просто отвечать на отдельные запросы; при этом для одной задачи требуется гораздо больше вызовов модели, чем в интерфейсе чата.
Снижение цены на 30% для модели среднего уровня уменьшает минимальную стоимость запуска агентов в масштабе — слоя, за доминирование над которым гонятся OpenAI, Anthropic и Google.
Её статус по умолчанию указывает на то, что Anthropic ожидает, что большинство агентных и кодинговых нагрузок перейдут на более дешёвую модель, а не на Opus. Партнёр Andreessen Horowitz, пишущий на Stratechery на этой неделе, утверждал, что агенты становятся тем «слоем агрегации», который приложения уже когда-то выполняли, и вознаграждение получит та лаборатория, которая делает агентные вычисления-инференс наиболее дешёвыми.
Запуск демонстрирует ценообразование и позиционирование Anthropic, а не обязательно среднюю производительность в обычный день. Неясно, насколько быстро конкуренты ответят аналогичными снижениями цен и сохранятся ли показатели бенчмарков, когда к моделям получат доступ не только исследователи.
Читайте далее: Группа по безопасности ИИ при поддержке Google, OpenAI, Anthropic приближается к запуску