Qwen3.8-Flash-Next: 125 миллиардов параметров с активацией 6 миллиардов на токен
Qwen3.8-Flash-Next: 125 миллиардов параметров с активацией 6 миллиардов на токен
Что произошло
Представлена модель Qwen3.8-Flash-Next. Общее количество параметров составляет 125 миллиардов, при этом на каждый токен активируется только 6 миллиардов параметров. Такая архитектура характерна для разреженных моделей (mixture-of-experts), где не все параметры используются одновременно.
Что изменилось по сравнению с предыдущей версией
Данные о предыдущих версиях Qwen не предоставлены. Однако для контекста: предыдущие модели серии Qwen, такие как Qwen2.5, имели плотную архитектуру (все параметры активны). Переход к разреженной архитектуре с активацией 6 миллиардов из 125 миллиардов — значительное изменение в дизайне.
Цены и доступность
Информация о цене, дате релиза и регионах доступности отсутствует.
Почему это важно
Разреженные модели (MoE) становятся стандартом в индустрии. Активация только части параметров на токен позволяет масштабировать модель без пропорционального роста вычислительных затрат. Qwen3.8-Flash-Next следует этому тренду.
Для пользователей AI-Sphere
Если модель станет доступна, её высокая эффективность может означать более быстрый ответ при меньших затратах на инференс. Следите за обновлениями в карточке модели на ai-sphere.ru.