Alibaba анонсировала модель Qwen3.8-Flash-Next как первый публичный релиз на архитектуре следующего поколения Qwen4. Открытые веса модели должны появиться 26 августа в 15:00 UTC.
Несмотря на обозначение Qwen3.8, команда прямо называет этот выпуск предварительным показом архитектуры Qwen4 и выпускает его заранее для подготовки разработчиков библиотек и систем инференса к полноценному релизу новой генерации. Это мультимодальная MoE-модель, которая выйдет в обычной и FP8-версиях.

Что официально подтверждено о Qwen3.8-Flash-Next.
В первой версии страницы ModelScope было более подробное описание, но затем его убрали; текст сохранился у пользователей в виде скриншотов и цитат. Если эти данные верны, речь идёт о системе с примерно 125 млрд основных параметров, дополнительными 51 млрд параметрами N-gram embeddings и активацией около 6 млрд параметров на токен. Сообщалось также об изменениях в attention, residual-связях, embeddings и оптимизации обучения. Таблицы с результатами при этом не публиковались.

Характеристики из удалённого описания ModelScope — использовать только с оговоркой.
Официально известно немногое. Подтверждено позиционирование Flash-Next как превью будущей линейки Qwen4, а также её мультимодальность и наличие версий обычная/FP8. Подробности временно были опубликованы на ModelScope, после чего удалены из карточки модели.


