👨💻 Сбер выпустил новое поколение моделей GigaEmbeddings Эмбеддинг-модели превращают текст в число
👨💻 Сбер выпустил новое поколение моделей GigaEmbeddings
Эмбеддинг-модели превращают текст в числовые векторы, чтобы ИИ искал информацию по смыслу, а не по точному совпадению слов. Это критично для поддержки клиентов, внутренних баз знаний и работы с документами.
В линейку вошли три модели: 480M, 3B и 10B-A1.8B. Все поддерживают vLLM и SGLang, поэтому их легко встроить в существующую инфраструктуру.
💡 По сравнению с прошлой версией выросло качество на английском и в коде. Флагман 10B-A1.8B набрал 74,99 в ruMTEB и занял первое место в рейтинге. Модель 3B ускорилась в 1,6 раза, а флагман — в 2 раза.
Веса выложены на GitVerse и Hugging Face под лицензией MIT:
➡️ HF: 480M 3B 10B-A1.8B
➡️ Gitverse: 480M 3B 10B-A1.8B
📌 Подробности читайте в посте команды.
Комментарии