18 июля 2026

eur = 89.90 0.57 (0.64 %)

btc = 63 929.00$ 1 059.48 (1.69 %)

eth = 1 844.97$ 15.31 (0.84 %)

gram = 1.48$ -0.01 (-0.54 %)

usd = 78.40 0.08 (0.10 %)

eur = 89.90 0.57 (0.64 %)

btc = 63 929.00$ 1 059.48 (1.69 %)

LLM Wildberries вошла в топ-3 русскоязычного бенчмарка MERA

1 минута на чтение
LLM Wildberries вошла в топ-3 русскоязычного бенчмарка MERA

Кодик кратко объясняет суть статьи

Модель BerryLM-XL от команды RWB вошла в топ-3 русскоязычного бенчмарка MERA, заняв третье место в общем рейтинге и второе среди ИИ-моделей с оценкой 0,835 (эталон — 0,852). Ещё одна модель RWB, BerryLM-v2, расположилась на пятом месте с результатом 0,810. Оценки основаны на 15 задачах, проверяющих работу с русским текстом, логику, знания и прикладные навыки. Модели используются в Wildberries для ИИ-ассистентов, поиска товаров и инструментов продавцов, а также для внутренней автоматизации. По оценке компании, их применение приносит свыше 1 млрд рублей дополнительной выручки в год. MERA — независимая платформа для оценки моделей по нескольким направлениям, включая текст, код и мультимодальные данные.

Читайте в Telegram

|

Большая языковая модель BerryLM-XL, дообученная командой RWB, вошла в топ-3 текстового рейтинга русскоязычного бенчмарка MERA.

По итогам тестирования модель получила интегральную оценку 0,835. Для сравнения, Human Benchmark — эталонная оценка на основе ответов людей на те же задания — составляет 0,852.

На момент публикации BerryLM-XL занимает третье место в общем рейтинге MERA и второе среди ИИ-моделей. Оценка формируется на основе 15 заданий, которые проверяют работу с русскоязычным текстом, знания, логику и прикладные навыки.

LLM Wildberries вошла в топ-3 русскоязычного бенчмарка MERA

В топ-5 рейтинга также вошла ещё одна модель RWB — BerryLM-v2. Она получила оценку 0,810 и заняла пятое место в лидерборде.

Модели семейства BerryLM используются в продуктах Wildberries: в ИИ-ассистенте для покупателей, сравнении и поиске товаров, а также в инструментах для продавцов, которые помогают готовить ответы на отзывы и вопросы покупателей.

Кроме того, модели применяются для автоматизации внутренних процессов RWB. По оценке компании, совокупный эффект от ИИ-инструментов на базе BerryLM превышает 1 млрд рублей дополнительной выручки в год.

MERA — открытый независимый бенчмарк для оценки моделей, работающих с русским языком. Помимо текстового рейтинга, платформа включает направления для проверки моделей на задачах с кодом, отраслевыми сценариями и мультимодальными данными.
Теги:
Обсудить
Блоги 732
ЦНИС
OTP Bank
Softline
Слетать.ру
ВКонтакте
StudyAI
билайн
Т-Банк
ВТБ
Газпромбанк

Привет, это Кодик! Я создан, чтобы помогать вам с  разными задачами. Задайте мне вопрос…