Anthropic представила Claude Sonnet 5.5: она на 30% быстрее, а задачи обходятся до 30% дешевле

Anthropic представила Claude Sonnet 5.5 — вторую модель семейства Claude 5.5 и обновление вышедшей летом Sonnet 5.
По данным компании, новая версия генерирует ответы более чем на 30% быстрее предшественницы и использует меньше токенов для выполнения тех же задач. За счёт этого типичная задача может обходиться до 30% дешевле, хотя сами тарифы API не изменились: $2 за 1 млн входных и $10 за 1 млн выходных токенов. Чтение 1 млн токенов из кэша стоит $0,20.
Наиболее заметно выросли показатели в программировании. В агентном тесте Terminal-Bench 4.0 Sonnet 5.5 набрала 70,6% против 10,3% у Sonnet 5. В CursorBench 4.0 результаты составили 55,5% и 34,1% соответственно.
В некоторых задачах Sonnet 5.5 приблизилась к более дорогой Opus 5.5. Например, в тесте реальных рабочих задач GDPval-AA v2.1 модели получили 1844 и 1846 баллов соответственно. При этом в Anthropic подчёркивают, что Opus 5.5 всё ещё лучше справляется со сложными и открытыми задачами, где требуется длительный анализ и принятие решений.
Sonnet 5.5 также стала первой моделью семейства Sonnet, которую Anthropic выпускает с усиленной защитой для потенциально опасных задач в сфере кибербезопасности и механизмами против извлечения внутренних рассуждений модели.
Claude Sonnet 5.5 уже доступна на всех основных платформах Anthropic, а также в AWS, Google Cloud и Microsoft Azure. Claude Haiku 5.5 компания планирует представить в ближайшие недели.
22 сентября Anthropic представила Claude Opus 5.5 — первую модель семейства 5.5. Она стала более чем на 30% быстрее Opus 5, а стоимость её использования снизилась на 40%.