LLM

Qwen3.8-Flash-Next: 125 миллиардов параметров с активацией 6 миллиардов на токен

Автор: AI-Sphere· обновлено 26 августа 2026 г. в 17:54· 2 мин чтения
Источники: the-decoder.com
## Qwen3.8-Flash-Next: 125 миллиардов параметров с активацией 6 миллиардов на токен

Qwen3.8-Flash-Next: 125 миллиардов параметров с активацией 6 миллиардов на токен

Что произошло

Представлена модель Qwen3.8-Flash-Next. Общее количество параметров составляет 125 миллиардов, при этом на каждый токен активируется только 6 миллиардов параметров. Такая архитектура характерна для разреженных моделей (mixture-of-experts), где не все параметры используются одновременно.

Что изменилось по сравнению с предыдущей версией

Данные о предыдущих версиях Qwen не предоставлены. Однако для контекста: предыдущие модели серии Qwen, такие как Qwen2.5, имели плотную архитектуру (все параметры активны). Переход к разреженной архитектуре с активацией 6 миллиардов из 125 миллиардов — значительное изменение в дизайне.

Цены и доступность

Информация о цене, дате релиза и регионах доступности отсутствует.

Почему это важно

Разреженные модели (MoE) становятся стандартом в индустрии. Активация только части параметров на токен позволяет масштабировать модель без пропорционального роста вычислительных затрат. Qwen3.8-Flash-Next следует этому тренду.

Для пользователей AI-Sphere

Если модель станет доступна, её высокая эффективность может означать более быстрый ответ при меньших затратах на инференс. Следите за обновлениями в карточке модели на ai-sphere.ru.

Источники

#Qwen3.8-Flash-Next#Alibaba#Mixture-of-Experts#экономия затрат

Читайте также

DeepSeek V4 FlashЦены на DeepSeek V4 FlashClaude Opus 4.6Цены на AI-моделиAlibabaНовости AlibabaOpenAIOpenAI — модели, продукты и новостиAnthropicAnthropic (Claude) — модели, продукты и новости

Попробуйте сами

Задайте вопрос любой нейросети прямо сейчас — без VPN и иностранной карты

Начать чат