Российская газета,
15:55, 21.09.2026
Тут могла бы быть ваша реклама
Яндекс выложил в опенсорс Alice AI Foundation LLM - претрейн-версию своей новой большой языковой модели, обученной полностью с нуля. Модель обгоняет в том числе более крупные опенсорс-модели, такие как DeepSeek-V4-Flash-Base и NVIDIA Nemotron-3-Super-120B-Base, и не требуя при этом больших вычислительных мощностей для инференса. Разработчики могут использовать её как в исследовательских, так и в коммерческих проектах благодаря свободной лицензии Apache 2.0.
Новая модель - это экспериментальная версия, на которой Яндекс тестирует архитектурные решения для своей будущей единой рассуждающей модели (ЕРМ). Рассуждающая модель ляжет в основу агентных возможностей Алисы AI, благодаря которым пользователи смогут поручать ей выполнение конкретных действий.
Alice AI Foundation LLM работает на архитектуре MoE (Mixture of Experts) и включает 80 миллиардов параметров, из которых в моменте активны только 3 миллиарда - это обеспечивает исключительную скорость и экономичность её работы. В модель заложены способности к рассуждению и работе в агентных сценариях. За счёт этого она показывает высокую эффективность в сложных логических заданиях и в программировании. Например, на олимпиадных задачах по математике она делит лидерство с Qwen3.5-35B-A3B-Base, решая подавляющее большинство заданий. А в тестах на написание кода превосходит модель компании NVIDIA Nemotron-3-Super-120B-Base - несмотря на то, что использует в четыре раза меньше активных параметров. Ка...