4 февраля 2026

eur = 90.72 -0.53 (-0.58 %)

btc = 76 561.00$ -2 107.03 (-2.68 %)

eth = 2 279.90$ -59.87 (-2.56 %)

ton = 1.40$ 0.04 (2.82 %)

usd = 76.98 -0.04 (-0.05 %)

eur = 90.72 -0.53 (-0.58 %)

btc = 76 561.00$ -2 107.03 (-2.68 %)

Сбер выложил в открытый доступ русскоязычную текстовую ИИ-модель ruGPT-3.5

1 минута на чтение
Сбер выложил в открытый доступ русскоязычную текстовую ИИ-модель ruGPT-3.5

Читайте в Telegram

|

Сбер открыл доступ к нейросетевой модели генерации текста для русского языка ruGPT-3.5 13B.

Её дообученная версия лежит в основе сервиса GigaChat. Также банк выложил новую версию модели mGPT 13B — самую большую из семейства многоязычных моделей Сбера, способную генерировать тексты на 61 языке.

Russian Generative Pretrained Transformer версии 3.5 (ruGPT-3.5 13B) — новая версия нейросети ruGPT-3 13B. Это современная модель генерации текста для русского языка на основе доработанной исследователями Сбера архитектуры GPT-3 от OpenAI. Модель ruGPT-3.5 13B содержит 13 млрд параметров и умеет продолжать тексты на русском и английском языках, а также на языках программирования.

Обучение модели производилось в два этапа. Первый этап продлился 1,5 месяца — за это время платформа обработала 300 Гбайт данных: книги, энциклопедийные и научные статьи, социальные ресурсы и другие источники. Потребовались ресурсы 512 ускорителей NVIDIA V100. На втором этапе проводилось дообучение на 110 Гбайт данных из датасета The Stack, юридических документов и обновлённых текстов «Википедии» — это заняло три недели и потребовало 200 ускорителей NVIDIA A100.

Модель доступна на HuggingFace, её могут использовать все разработчики.

Блоги 465
OTP Bank
билайн
Т-Банк
Газпромбанк
МТС
X5 Tech
Сбер
Яндекс Практикум
Ozon Tech
Циан

Пользуясь сайтом, вы соглашаетесь с политикой конфиденциальности
и тем, что мы используем cookie-файлы