
28 сентября Anthropic анонсировала модель Claude Sonnet 5.5, которая работает более чем на 30% быстрее и стоит на 30% меньше за задачу по сравнению с предшественником, моделью Sonnet 5. Новая модель сохраняет цены на уровне 2 долларов за миллион входных токенов и 10 долларов за миллион выходных токенов. Команда Anthropic сообщила, что Sonnet 5.5 получила 70,6% на тесте Terminal-Bench 4.0, тогда как Sonnet 5 набрала лишь 10,3%, а Opus 5.5 – 66,4%.
Sonnet 5.5 стала второй моделью в семействе Claude 5.5. 22 сентября Anthropic также запустила Opus 5.5, в тот же день OpenAI выпустила модели GPT-6 Sol и Luna. Anthropic отметила, что Sonnet 5.5 не расширяет свои возможности, а ее обзор по согласованию сосредоточен на рисках, таких как введение в заблуждение пользователей и помощь в высокостенных злоупотреблениях. Модель также включает кибер-защиту и анти-дистилляцию, что предотвращает попытки извлечения ее логики для обучения конкурентных систем. В ближайшие недели ожидается выход Claude Haiku 5.5.
Тем не менее, независимая аналитическая компания Artificial Analysis, проведя тестирование, пришла к иному заключению относительно стоимости. По их данным, Sonnet 5.5 использовала значительно больше токенов для достижения результатов. Анализ показал, что при максимальной нагрузке Sonnet 5.5 использовала около 193 тыс. выходных токенов на задачу в индексе Intelligence, что на 60% выше, чем у Opus 5.5, и примерно в 7 раз больше, чем у GPT-6 Astra. Однако клиенты, имеющие ранний доступ, сообщили о противоположной тенденции по сравнению с Sonnet 5. Например, Balyasny Asset Management указала, что на своих финансовых задачах Sonnet 5.5 использовала около 121 тыс. токенов на ответ, в то время как Sonnet 5 – 497 тыс. Artificial Analysis провела тестирование предварительной версии модели с ошибкой в структурированном выводе, что было исправлено Anthropic. Компания планирует повторно провести соответствующие оценки в ближайшем будущем.





