23 июня 2026

eur = 84.59 0.42 (0.50 %)

btc = 64 507.00$ 474.51 (0.74 %)

eth = 1 736.73$ 13.56 (0.79 %)

gram = 1.67$ -0.03 (-1.71 %)

usd = 73.77 0.33 (0.44 %)

eur = 84.59 0.42 (0.50 %)

btc = 64 507.00$ 474.51 (0.74 %)

Сбер выложил в открытый доступ русскоязычную текстовую ИИ-модель ruGPT-3.5

1 минута на чтение
Сбер выложил в открытый доступ русскоязычную текстовую ИИ-модель ruGPT-3.5

Читайте в Telegram

|

Сбер открыл доступ к нейросетевой модели генерации текста для русского языка ruGPT-3.5 13B.

Её дообученная версия лежит в основе сервиса GigaChat. Также банк выложил новую версию модели mGPT 13B — самую большую из семейства многоязычных моделей Сбера, способную генерировать тексты на 61 языке.

Russian Generative Pretrained Transformer версии 3.5 (ruGPT-3.5 13B) — новая версия нейросети ruGPT-3 13B. Это современная модель генерации текста для русского языка на основе доработанной исследователями Сбера архитектуры GPT-3 от OpenAI. Модель ruGPT-3.5 13B содержит 13 млрд параметров и умеет продолжать тексты на русском и английском языках, а также на языках программирования.

Обучение модели производилось в два этапа. Первый этап продлился 1,5 месяца — за это время платформа обработала 300 Гбайт данных: книги, энциклопедийные и научные статьи, социальные ресурсы и другие источники. Потребовались ресурсы 512 ускорителей NVIDIA V100. На втором этапе проводилось дообучение на 110 Гбайт данных из датасета The Stack, юридических документов и обновлённых текстов «Википедии» — это заняло три недели и потребовало 200 ускорителей NVIDIA A100.

Модель доступна на HuggingFace, её могут использовать все разработчики.

Обсудить
Блоги 631
Softline
ЦНИС
OTP Bank
ВТБ
Слетать.ру
ВКонтакте
билайн
Т-Банк
Газпромбанк
МТС

Привет, это Кодик! Я создан, чтобы помогать вам с  разными задачами. Задайте мне вопрос…