Китайские компании выпустили 16 новых моделей вопреки призыву замедлить развитие ИИ

Десять ведущих китайских разработчиков ИИ выпустили в сентябре 16 новых моделей. Такой подсчёт привело издание Nikkei Asia.
Среди них модели DeepSeek и Xiaomi. В подсчёт вошли только новые модели, а не доработки уже существующих, часть из них генерирует аудио и видео. Релизы пришлись на месяц, когда глава Anthropic Дарио Амодеи опубликовал эссе с призывом к отрасли замедлить развитие ИИ из-за растущих рисков.
По данным сайта BenchLM, с июля по сентябрь восемь крупных китайских разработчиков выпустили 20 больших языковых моделей. Во втором квартале их было 17, в первом всего две. Американские компании с января по сентябрь выпустили 59 моделей, на 50 % больше, чем китайские.
Китайские компании делают ставку на компактные модели с умеренным числом параметров, которые дёшево обходятся в работе. Спрос на такие модели растёт вместе с распространением ИИ-агентов, которые расходуют много токенов. По данным Nikkei Asia, то же задание на китайской модели может обходиться в 20–50 раз дешевле, чем на передовых моделях Anthropic.
Как ранее рассказывал «Код.ру», американские компании всё чаще переходят на китайские модели из-за роста цен на ИИ.
В сентябре Alibaba объявила о планах создать версию Qwen с 5–10 трлн параметров, у предыдущей флагманской модели серии, вышедшей в августе, их 2,4 трлн. По возможностям передовые американские модели пока впереди, но отставание, по оценке экспертов, на которых ссылается Nikkei Asia, сокращается.
В своём эссе Амодеи также призвал ужесточить экспортный контроль за ИИ-чипами и бороться с дистилляцией, то есть обучением китайских моделей на ответах американских. Глава DeepSeek Лян Вэньфэн в сентябре стал соавтором научной работы о безопасных методах обучения ИИ-агентов.