НОВОСТИ

Яндекс открыл AliceAI-Foundation: 80 млрд, 3 млрд активных

Яндекс выложил претрейн AliceAI-Foundation: 80 млрд параметров, 3 млрд активных, обучение с нуля, Apache 2.0. WikiWebFacts и HardMultiQA. Это база, не чат.

Яндекс открыл AliceAI-Foundation: 80 млрд, 3 млрд активных
Содержание 4
  1. 0180 миллиардов стоят, 3 миллиарда считают
  2. 02Свои замеры и два русских бенчмарка
  3. 03Минск: скачать можно, в розетку не вставишь
  4. 0421 сентября 2026, Минск. Текст: TehnoRex

Это не чат-Алиса и не кнопка в приложении. Яндекс выложил веса базовой модели AliceAI-Foundation-80B-A3B-Base: Apache 2.0, Hugging Face, без затвора. Обучали с нуля — не докручивали чужой чекпойнт. Предыдущая закрытая Alice AI LLM 235B в декабрьском техрепорте ещё стартовала с весов Qwen3-235B-A22B. Здесь путь другой: свой корпус, своя схема слоёв, около полугода до релиза.

80 миллиардов стоят, 3 миллиарда считают

Архитектура гибридная, со слоями MoE. Всего 80 млрд параметров, на каждый токен активны 3 млрд. 48 слоёв, словарь на 129 024 токена, скрытое состояние 2048. В MoE-слое 512 маршрутизируемых экспертов, top-k 10 плюс один общий. Карточка модели обещает контекст до 262 144 токенов; в отчёте длинный контекст на бенчмарках держат на 128K. Это претрейн, не instruct: готового «ответь как Алиса» из коробки нет, для диалога нужен свой посттрейн.

Первая стадия претрейна — 17,5 трлн токенов при контексте 8K. Дальше отдельные этапы на 32K и 256K, затем reasoning. Ключевые развилки команда проверяла отдельными обучениями с нуля по 2 трлн токенов. Набор для vLLM в карточке рассчитан на несколько GPU: это не модель «на ноутбуке за вечер», в отличие от компактных открытых весов вроде LingBot World 2 Small на 1,3 млрд.

Свои замеры и два русских бенчмарка

В таблицах Яндекса Foundation обходит более крупные открытые претрейны DeepSeek-V4-Flash-Base и Nemotron-3-Super-120B на многих фактологических, математических и кодовых задачах. На IMO AnswerBench и LiveCodeBench компания ставит её первой среди сравниваемых открытых баз. Закрытую Alice AI LLM 235B октября 2025-го новая база обходит по фактам, математике, коду и длинному контексту — при почти втрое меньшем общем числе параметров и примерно в семь раз меньшем числе активных. Это внутренние прогоны на vLLM, не независимый лидерборд. Чужие цифры OpenAI тут ни при чём: GPT-6 Astra живёт в другой витрине.

Вместе с весами открыты WikiWebFacts и HardMultiQA — русскоязычные фактологические наборы. Первый: 1 365 коротких вопросов из популярных статей «Википедии» и поисковых запросов, лицензия CC BY-SA 4.0. Второй: 670 более жёстких заданий по мотивам запросов к Алисе, несколько форматов ответа. Оба просят не размножать датасет публичными копиями, чтобы вопросы не утекли в чужие корпуса. Сама Foundation — шаг к единой рассуждающей модели, на которой Яндекс собирает агентные навыки Алисы. Это не тот голосовой контур, который уже продают бизнесу: Алиса AI для компаний — отдельный продукт.

Минск: скачать можно, в розетку не вставишь

В Беларуси. Веса открыты, карточка не gated. Запустить локально — вопрос стойки с видеокартами, не витрины в Минске. Приложение Алисы у части пользователей уже стоит; Foundation его не заменяет и в магазин приложений не кладётся. Смотреть лицензию Apache 2.0, карточку yandex/AliceAI-Foundation-80B-A3B-Base и то, что это база под дообучение, а не готовый ассистент. Для сравнения открытых научных весов рядом лежит другой жанр: IBM и NASA отдали модель для Луны — узкая задача, не общий претрейн.

21 сентября 2026, Минск. Текст: TehnoRex

ПОДПИШИТЕСЬ НА РАССЫЛКУ

Новые обзоры и сравнения — на почту