9 августа 2026

eur = 94.84 0.78 (0.83 %)

btc = 64 743.00$ - 209.94 (-0.20 %)

eth = 1 911.66$ -4.11 (0.00 %)

gram = 1.35$ -0.01 (-0.20 %)

usd = 82.17 0.76 (0.93 %)

eur = 94.84 0.78 (0.83 %)

btc = 64 743.00$ - 209.94 (-0.20 %)

LLM Wildberries вошла в топ-3 русскоязычного бенчмарка MERA

1 минута на чтение
LLM Wildberries вошла в топ-3 русскоязычного бенчмарка MERA

Кодик кратко объясняет суть статьи

Модель BerryLM-XL от команды RWB вошла в топ-3 русскоязычного бенчмарка MERA, заняв третье место в общем рейтинге и второе среди ИИ-моделей с оценкой 0,835 (эталон — 0,852). Ещё одна модель RWB, BerryLM-v2, расположилась на пятом месте с результатом 0,810. Оценки основаны на 15 задачах, проверяющих работу с русским текстом, логику, знания и прикладные навыки. Модели используются в Wildberries для ИИ-ассистентов, поиска товаров и инструментов продавцов, а также для внутренней автоматизации. По оценке компании, их применение приносит свыше 1 млрд рублей дополнительной выручки в год. MERA — независимая платформа для оценки моделей по нескольким направлениям, включая текст, код и мультимодальные данные.

Читайте в Telegram

|

Большая языковая модель BerryLM-XL, дообученная командой RWB, вошла в топ-3 текстового рейтинга русскоязычного бенчмарка MERA.

По итогам тестирования модель получила интегральную оценку 0,835. Для сравнения, Human Benchmark — эталонная оценка на основе ответов людей на те же задания — составляет 0,852.

На момент публикации BerryLM-XL занимает третье место в общем рейтинге MERA и второе среди ИИ-моделей. Оценка формируется на основе 15 заданий, которые проверяют работу с русскоязычным текстом, знания, логику и прикладные навыки.

LLM Wildberries вошла в топ-3 русскоязычного бенчмарка MERA

В топ-5 рейтинга также вошла ещё одна модель RWB — BerryLM-v2. Она получила оценку 0,810 и заняла пятое место в лидерборде.

Модели семейства BerryLM используются в продуктах Wildberries: в ИИ-ассистенте для покупателей, сравнении и поиске товаров, а также в инструментах для продавцов, которые помогают готовить ответы на отзывы и вопросы покупателей.

Кроме того, модели применяются для автоматизации внутренних процессов RWB. По оценке компании, совокупный эффект от ИИ-инструментов на базе BerryLM превышает 1 млрд рублей дополнительной выручки в год.

MERA — открытый независимый бенчмарк для оценки моделей, работающих с русским языком. Помимо текстового рейтинга, платформа включает направления для проверки моделей на задачах с кодом, отраслевыми сценариями и мультимодальными данными.
Теги:
Обсудить
Блоги 783
Softline
OTP Bank
ЦНИС
билайн
ВКонтакте
StudyAI
Слетать.ру
Т-Банк
ВТБ
Газпромбанк

Привет, это Кодик! Я создан, чтобы помогать вам с  разными задачами. Задайте мне вопрос…