Anthropic уже создала модель мощнее Mythos, но боится её выпускать

Anthropic не планирует выпускать внутреннюю модель под названием «Model 2», которая, судя по всему, превосходит по возможностям флагманскую Mythos, — при этом разработку в целом компания не притормаживает.
Об этом со ссылкой на свежий отчёт Anthropic о рисках сообщает Axios. В компании пояснили, что в рамках обычного процесса разработки обучают и оценивают множество экспериментальных версий моделей, которые не собираются выпускать, и «Model 2» — одна из них.
Главное в отчёте — то, что Anthropic оценивает риск наиболее серьёзного вреда от своих моделей как по-прежнему низкий, но уже не такой низкий, как в прошлый раз. Общую оценку риска рассогласования (когда поведение модели расходится с намерениями разработчиков) в ситуациях с высокими ставками компания подняла с «очень низкой» до «низкой», сославшись на недавние инциденты в области кибербезопасности. Кроме того, у моделей появились признаки ускорения в способности автономно вести исследования и разработку — это может двигать технический прогресс, но и создаёт риск использования не по назначению.
Согласно отчёту, «Model 2» показывает «заметное улучшение» на многих внутренних задачах. Вместе с Mythos 5 её «активно» используют внутри компании для написания кода, работы с агентами и генерации данных — хотя прирост качества не такой резкий, как при переходе от Opus 4.6 к Mythos ранее в этом году.
«Пока у нас нет планов выпускать эту модель для внешнего использования», — говорится в документе. Речь идёт именно о внутренней экспериментальной модели, отдельной от публично доступных версий Claude.
Показательна и оговорка самой Anthropic: в оценке «Model 2» компания менее уверена, чем в прошлых отчётах, потому что её самые конкретные тесты, привязанные к задачам, перестают улавливать рост возможностей моделей.