
28 қыркүйекте Anthropic Claude Sonnet 5.5 моделін жариялады, ол алдыңғы модель Sonnet 5-пен салыстырғанда 30%-дан астам жылдамырақ жұмыс істейді және 30% арзан тұрады. Жаңа модель кіріс токендеріне 1 миллионға 2 доллар және шығыс токендеріне 1 миллионға 10 доллар деңгейінде бағаны сақтайды. Anthropic командасы Sonnet 5.5 Terminal-Bench 4.0 тестінде 70,6% жинағанын, ал Sonnet 5 тек 10,3% жинағанын, ал Opus 5.5 – 66,4% жинағанын хабарлады.
Sonnet 5.5 Claude 5.5 отбасының екінші моделі болды. 22 қыркүйекте Anthropic Opus 5.5 моделін де іске қосты, сол күні OpenAI GPT-6 Sol және Luna модельдерін шығарды. Anthropic Sonnet 5.5 мүмкіндіктерін кеңейтпейтінін, ал оның келісім шолуы пайдаланушыларды адастыру және жоғары деңгейлі теріс пайдалану сияқты қауіптерге назар аударатынын атап өтті. Модель сонымен қатар киберқорғауды және анти-дистилляцияны қамтиды, бұл оның логикасын бәсекелес жүйелерді оқыту үшін алу әрекеттерін болдырмайды. Алдағы апталарда Claude Haiku 5.5 шығуы күтілуде.
Дегенмен, Artificial Analysis тәуелсіз аналитикалық компаниясы тестілеу жүргізіп, шығындар бойынша басқа қорытындыға келді. Олардың мәліметтері бойынша, Sonnet 5.5 нәтижелерге қол жеткізу үшін айтарлықтай көп токендер қолданды. Талдау көрсеткендей, максималды жүктемеде Sonnet 5.5 Intelligence индексіндегі тапсырма үшін шамамен 193 мың шығыс токендер қолданған, бұл Opus 5.5-пен салыстырғанда 60% жоғары және GPT-6 Astra-мен салыстырғанда шамамен 7 есе көп. Алайда, ерте қол жеткізуге ие клиенттер Sonnet 5-пен салыстырғанда кері тенденция туралы хабарлады. Мысалы, Balyasny Asset Management қаржылық тапсырмаларында Sonnet 5.5 жауап үшін шамамен 121 мың токен қолданғанын, ал Sonnet 5 – 497 мың қолданғанын көрсетті. Artificial Analysis құрылымдалған шығудағы қателікпен алдын ала модельді сынақтан өткізді, оны Anthropic түзетті. Компания жақын арада тиісті бағалауларды қайта жүргізуді жоспарлап отыр.





