GigaEmbeddings: новые модели эмбеддингов от Сбера для смыслового поиска

Новое поколение моделей GigaEmbeddings от Сбера

Сбер анонсировал выпуск нового поколения моделей машинного обучения GigaEmbeddings, предназначенных для быстрого и точного поиска информации по смыслу. Это значимое обновление открывает новые возможности для автоматизации работы с текстовыми данными в различных бизнес-сценариях.

Модели семейства GigaEmbeddings решают ключевую задачу семантического поиска, позволяя находить релевантные документы, ответы и данные даже при отсутствии точного совпадения ключевых слов. Технология востребована в системах поддержки клиентов, для навигации по внутренним базам знаний, а также при обработке и анализе больших объемов документации.

В обновленную линейку вошли три модели с различной производительностью и вычислительной сложностью: компактная 480M, сбалансированная 3B и флагманская 10B-A1.8B. Все они поддерживают современные фреймворки инференса vLLM и SGLang, что обеспечивает гибкость при интеграции в существующую инфраструктуру.

Разработчики отмечают существенный рост качества моделей по сравнению с предыдущей версией, особенно в задачах, связанных с английским языком и программным кодом. Прирост качества у модели 3B составил 14,5 пункта. Флагманская модель 10B-A1.8B продемонстрировала впечатляющий результат, набрав 74,99 балла и заняв первое место в авторитетном бенчмарке ruMTEB, который оценивает качество русскоязычных эмбеддингов.

Помимо повышения точности, разработчикам удалось значительно ускорить работу моделей. Скорость инференса модели 3B выросла в 1,6 раза, а флагманской модели — в 2 раза. Это делает использование GigaEmbeddings еще более эффективным и экономически выгодным для высоконагруженных сервисов.

Ключевым преимуществом нового релиза является его открытость. Веса всех трех моделей опубликованы на платформах GitVerse и Hugging Face. Они доступны для бесплатного использования под либеральной лицензией MIT, что позволяет как исследователям, так и коммерческим компаниям свободно интегрировать передовые технологии семантического поиска в свои проекты без ограничений.

Подробная техническая информация, примеры использования и документация доступны в официальном посте команды разработчиков. Новое поколение GigaEmbeddings от Сбера — это серьезный шаг вперед в развитии технологий обработки естественного языка на русском языке, предоставляющий мощный и доступный инструмент для решения широкого круга прикладных задач.