Яндекс опубликовал на Hugging Face базовую языковую модель Alice AI Search Pretrain. По сообщению компании, она обучена с нуля, а её дообученная версия лежит в основе коротких ответов в Поиске; опубликованная версия прошла только первый этап обучения, поэтому её нельзя считать готовым универсальным сервисом без дополнительной настройки.
Модель сочетает архитектуры Encoder-Decoder и Mixture of Experts (MoE). Яндекс заявляет 35 млрд параметров, но при обработке одного токена активируется около 600 млн — менее 2% общего числа. Такой подход, по описанию компании, снижает вычислительную нагрузку и позволяет обрабатывать большой поток документов.
Веса модели доступны на Hugging Face под лицензией Apache 2.0. Яндекс приводит результаты слепого сравнения ответов на русском языке с несколькими компактными моделями и считает Alice AI Search Pretrain сопоставимой с Qwen 3.5 35B-A3B. Эти оценки принадлежат самой компании; независимой проверки в публикации нет. С июля в Поиске работает дообученная версия Alice AI Search, а не опубликованный pretrain напрямую.