GPT-6 Astra запустили на всех платных тарифах ChatGPT — но независимые тесты не впечатлили

OpenAI открыла доступ к новейшей модели GPT-6 Astra для пользователей платных подписок ChatGPT.
Об этом сообщил глава компании Сэм Альтман. Сначала модель получили подписчики тарифов Pro, Enterprise и Business Premium, а затем — Plus и Business; единственный платный тариф, где Astra пока недоступна, — начальный Go.
Модель работает в инструментах Codex и ChatGPT Work: на Plus и Business доступно примерно от 5 до 45 запросов за пять часов, на Pro — от 25 до 225, а на версии Pro с двадцатикратными лимитами — до 900. В API Astra добавили по цене $10 за миллион входных токенов, $50 за миллион выходных и $1 за миллион кэшированных.
Что показали независимые тесты
Пока OpenAI называет Astra революционной системой, независимая проверка охладила ожидания. Компания Artificial Analysis, которая тестирует модели по единой открытой методологии без участия разработчиков, выяснила, что в общем зачёте Astra выступила примерно на одном уровне с предшественницей.
В сводном рейтинге интеллекта (Intelligence Index) она набрала 61 балл — ровно столько же, сколько прежняя GPT-5.6 Sol. Для сравнения, Claude Fable 5.1 от Anthropic получила 66 баллов, а Meta (признана в России экстремистской и запрещена) Muse Spark 1.3 — 62 балла, то есть новинка OpenAI уступила обеим.
Лучше всего Astra показала себя в программировании. В рейтинге агентного кодинга (Coding Agent Index) в среде Codex она набрала 67 баллов — примерно наравне с Claude Opus 5 и Fable 5, хотя лидерство сохранила Fable 5.1 в Claude Code с 70 баллами.
При этом по сравнению с GPT-5.6 Sol новая модель подорожала в 2,5 раза. Частично это компенсирует резко возросшая экономичность: Astra расходует примерно треть токенов от прежней модели, поэтому в задачах на код работа с ней при максимальных усилиях выходит примерно как с предшественницей — но в задачах на «чистый интеллект» экономия куда скромнее, и в пересчёте на задачу Astra оказывается на 75% дороже, чем Claude Fable 5.
Результаты по конкретным тестам оказались неоднородными. Заметно снизилась частота галлюцинаций по тесту AA-Omniscience — с 92% до 51%; модель прибавила в работе с крупными проектами из тысяч файлов и немного улучшилась в тесте с упором на математику и код. Но в наборе практических задач для 44 профессий Astra, наоборот, просела, а в ряде тестов — от поддержки клиентов до анализа больших документов — потеряла по два-три балла.
Итог независимой оценки: GPT-6 Astra стала выгоднее в написании кода, но пока не смогла обойти модели Anthropic в области общего интеллекта — и на «революцию», обещанную OpenAI, по этим данным не тянет.