
Команда RWB (подразделение Wildberries) добилась впечатляющего результата: их дообученная языковая модель BerryLM-XL на 358 млрд параметров заняла третье место в авторитетном русскоязычном бенчмарке MERA. Показатель модели составил 0,835, что позволило ей войти в топ-3, уступив лишь эталону на основе человеческих ответов (0,852) и лидеру рейтинга — Claude Opus 4.6 (0,862).
MERA — это ключевой русскоязычный бенчмарк, который оценивает искусственный интеллект по множеству критериев: логика, научные рассуждения, этика, общие знания о мире и другие области. Попадание BerryLM-XL в тройку лидеров подтверждает высокий уровень разработки и глубокое понимание специфики русского языка.
Однако команда RWB не останавливается на достижении «сухих цифр». Модели семейства BerryLM уже активно применяются в реальных бизнес-процессах Wildberries. Они используются в ИИ-ассистенте для покупателей, системах сравнения и поиска товаров, а также в инструментах для продавцов, которые помогают автоматически отвечать на отзывы и вопросы.
«Дообучение и интеграция наших LLM решают конкретную бизнес-задачу: превращают сложную технологию в прикладной инструмент, который помогает пользователям быстрее принимать решения, а продавцам — эффективнее развивать свой бизнес», — отметил Павел Раваев, директор по данным RWB.
Финансовая отдача от внедрения ИИ уже ощутима. По оценке RWB, использование моделей на базе BerryLM приносит компании более 1 млрд рублей дополнительной выручки в год. Это наглядный пример того, как передовые технологии могут приносить измеримую пользу бизнесу и пользователям.
Таким образом, успех BerryLM-XL в бенчмарке MERA — не просто научное достижение, а важный шаг к созданию практичных и эффективных ИИ-решений для массового рынка.




