Anthropic представила Sonnet 5.5: новая модель почти обогнала Opus

Новая модель демонстрирует скорость более чем на 30% превышающую её предшественницу и в некоторых тестах приблизилась к Opus 5.5, при этом сохранив прежнюю цену API

1 октября 2026, 00:30Искусственный интеллектAnthropicSonnetDarth Sahara0

Компания Anthropic представила Claude Sonnet 5.5 — вторую модель в линейке Claude 5.5 после флагманской Opus 5.5. Новинка позиционируется как более быстрая и доступная модель для выполнения повседневных задач с чёткими целями: исправление кода, работа с документами, презентациями и таблицами. В ряде сложных тестов Sonnet 5.5 уже близка по результатам к Opus 5.5.

Особенно заметен прогресс в программировании. В тесте Terminal-Bench 4.0, который оценивает способность модели выполнять многоэтапные задачи через командную строку, Sonnet 5.5 получила 70,6% против 10,3% у Sonnet 5. Для сравнения, Opus 5.5 показала 66,4% на своём максимальном уровне. В CursorBench 4.0 Sonnet 5.5 набрала 55,5%, а Opus 5.5 — 57,8%.

В работе с компьютером разница ещё меньше: в OSWorld 2.1 Sonnet 5.5 получила 80,1% баллов против 81,8% у Opus 5.5 и 57% у Sonnet 5. В тесте GDPval-AA v2.1, который имитирует реальные профессиональные задачи в 44 профессиях, результаты составили 1844 и 1846 баллов соответственно. Anthropic отмечает, что результаты Sonnet 5.5 в GDPval-AA были получены на предварительной версии модели с ошибками в работе со структурированным выводом, и компания ожидает, что исправления лишь незначительно улучшат показатели.

Источник изображения: Anthropic

У новой модели есть и необычный практический тест: Sonnet 5.5 стала первой моделью в линейке Sonnet, которая смогла пройти Pokémon Red, ориентируясь исключительно на скриншоты игры. Anthropic использует этот результат как пример способности модели работать с длинными последовательностями действий и визуальной информацией.

Однако Sonnet 5.5 не предназначена для полной замены Opus 5.5. Anthropic описывает Opus как модель для сложных задач, требующих длительного анализа и автономного принятия решений, в то время как Sonnet в первую очередь предназначена для чётко определённых задач. В некоторых тестах на максимальном уровне усилий результаты двух моделей сопоставимы, но для открытых задач, требующих длительного самостоятельного анализа, Opus 5.5 по-прежнему превосходит.

Sonnet 5.5 генерирует ответы более чем на 30% быстрее, чем Sonnet 5, и обычно использует меньше токенов, благодаря чему Anthropic ожидает снижение стоимости выполнения стандартной задачи до 30%.

При этом цена токенов осталась прежней: $2 за миллион входных токенов и $10 за миллион выходных, а чтение из кэша стоит $0,20 за миллион токенов. Модель уже доступна в Claude, через API, а также на облачных платформах Amazon Web Services, Google Cloud и Microsoft Azure.

Источники:AnthropicSystem Card Claude SonnetИскусственный интеллект0Искусственный интеллектAnthropicClaude Sonnet29 минут назад

Источник
Елизавета Воронцова

Журналист информационного портала vtambove.ru. Освещает городские события, общественную повестку, социальные инициативы и актуальные новости региона. В работе придерживается принципов точности, оперативности и понятной подачи информации. Особое внимание уделяет темам, которые напрямую влияют на жизнь жителей Тамбова и области.

Оцените автора
Тамбов