26 августа 2026, 16:48
Qwen показала Qwen3.8-Flash и раскрыла архитектуру будущего Qwen4

Alibaba представила Qwen3.8-Flash и показала раннюю версию архитектуры, которая станет основой следующего поколения Qwen4.
Qwen3.8-Flash — мультимодальная MoE-модель с упором на высокую производительность инференса. Основная модель содержит 125 млрд параметров, из которых на каждом токене активируется только приблизительно 6 млрд. Дополнительно используется 51 млрд параметров N-gram embeddings — отдельная таблица эмбеддингов, которая дополняет основную модель.
Контекстное окно Qwen3.8-Flash составляет 262 тыс. токенов. Через YaRN его можно расширять до 1 млн токенов. Сама модель мультимодальная и рассчитана не только на текстовые, но и на визуальные задачи.

Основной апдейт коснулся архитектуры. Qwen сочетает Gated DeltaNet (GDN) с новым вариантом разреженного внимания Qwen Sparse Attention (QSA). Такой гибридный сеханизм внимания должен снизить стоимость обработки длинного контекста по сравнению с использованием полного attention на всех слоях.
В архитектуру равным образом добавили Gated Residual, N-gram Embedding и новый для этой линейки вариант оптимизатора Muon. Qwen позиционирует эти изменения не как точечные улучшения Qwen3, а как набор архитектурных решений, которые будут использоваться в следующем поколении моделей.
Отдельно команда подчеркивает производительность обучения: по заявлению Qwen, стоимость подготовки Qwen3.8-Flash-Next составила примерно 0,1 от сопоставимого обучения Qwen3.7-Plus. Одновременно авторы заявляют сопоставимый совокупный уровень возможностей и более сильные результаты в кодинге и задачах типа cowork.
Бенчмарки Qwen3.8-Flash
DeepSWE 1.1 — 58,7%;
SWE-bench Pro — 62,5%;
CoWorkBench — 73,9%;
AndroidWorld — 84,5%;
MathVision — 95,7%.
Qwen пытается получить производительность значительно более крупной модели за счет сочетания MoE, разреженного attention и дополнительных механизмов памяти.

Еще интереснее Qwen3.8-Flash-Next. Это отдельная открытая модель, которую Qwen выпускает как ранний preview архитектуры Qwen4. В Hugging Face она прямо обозначена как "A Preview of the Qwen4 Architecture". Qwen фактически выносит архитектурные изменения Qwen 4 в отдельный релиз заранее. Можно пощупать и изучить новую конструкцию, подготовиться к следующему семейству моделей еще до выхода полноценного Qwen4.
Производственную версию Qwen3.8-Flash компания планирует добавить в QwenCloud. Заявленная цена составляет $0,16 за 1 млн входных токенов и $0,47 за 1 млн выходных.
Читают сейчас

3 часа назад
В США предъявили обвинения россиянину в заражении компьютеров более 80 тысяч фрилансеров вредоносным ПО
Коллегия присяжных в штате Калифорния предъявила обвинения 40-летнему гражданину России Серажудину Актулаеву за участие в фишинговой кампании, в результате которой компьютеры 80 тыс. фрилансеров были
3 часа назад
Лиды по осени считают: 6 мероприятий для продуктивного сентября
Осенью прогноз простой: где-то обязательно польет. С рекламным рынком сложнее. Где подорожает лид? Какой канал упрется в потолок? Сработает ли UGC? Что уже можно поручить ИИ? И какие изменения в закон

4 часа назад
Организация Postgres Professional первой среди коммерческих форков закрыла критические уязвимости PostgreSQL
Postgres Professional выпустила «нулевые» релизы корпоративных редакций СУБД Postgres Pro с исправлениями актуальных уязвимостей PostgreSQL. Компания первой и пока единственной среди коммерческих форк

4 часа назад
Дайджест GetAClass: август 2026
Поздравляем всех с началом нового учебного года! Каникулы закончились – значит, пора подвести итоги последнего летнего месяца. Читать далее

4 часа назад
НАСА выбрало компанию Blue Origin в качестве поставщика телекоммуникационной сети для Марса
Американское космическое агентство заключило с Blue Origin контракт на разработку Mars Telecommunications Network — системы обеспечения высокоскоростной связи и навигации для текущих и будущих миссий