🤖 Яндекс выложил в open source модель на 80 млрд параметров
AliceAI-Foundation-80B-A3B-Base обучена с нуля и использует архитектуру MoE: всего 80 млрд параметров, но на каждый токен активируются только 3 млрд.
Контекст — до 262 тысяч токенов, внутри 512 экспертов, лицензия — Apache 2.0.
Это базовая модель после претрейна, а не готовый чат-ассистент.
Главный акцент — русскоязычный контекст. В тестах Яндекса модель обошла более крупную DeepSeek-V4-Flash-Base на двух бенчмарках, связанных с русскоязычными знаниями.
📦 Модель на Hugging Face
Это уже второй open-source релиз Яндекса за две недели.
💬 Что интереснее: открытая модель или готовый ассистент?
AliceAI-Foundation-80B-A3B-Base обучена с нуля и использует архитектуру MoE: всего 80 млрд параметров, но на каждый токен активируются только 3 млрд.
Контекст — до 262 тысяч токенов, внутри 512 экспертов, лицензия — Apache 2.0.
Это базовая модель после претрейна, а не готовый чат-ассистент.
Главный акцент — русскоязычный контекст. В тестах Яндекса модель обошла более крупную DeepSeek-V4-Flash-Base на двух бенчмарках, связанных с русскоязычными знаниями.
📦 Модель на Hugging Face
Это уже второй open-source релиз Яндекса за две недели.
💬 Что интереснее: открытая модель или готовый ассистент?