Qwen4: Архитектура будущего

Master_AI 2 часа назад Qwen4: Архитектура будущего Средний 10 мин 2.6K Блог компании GPTunneL Искусственный интеллект Машинное обучение * Open source * IT-компании Обзор Окей, щас будет лонгрид.26 августа 2026 интернет...
<5 — 2026'da uzaya kaç SpaceX Starship fırlatması ulaşacak?
Значимый прорыв формирует отрасль ИИ: Master_AI 2 часа назад Qwen4: Архитектура будущего Средний 10 мин 2. 6K Блог компании GPTunneL Искусственный интеллект Машинное обучение * Open source * IT-компании Обзор Окей, щас будет лонгрид. 26 августа 2026 интернет на пару часов забыл про всё.
8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open‑weight! » И цифры… 125 миллиардов параметров всего. Плюс ещё 51 млрд отдельным слоем.
Технические детали
А активируется на каждый токен — лишь 6 миллиардов. Первая мысль была: так не бывает. Coming soonТут надо сразу расставить точки, потому что вокруг названия путаница — это уже отдельный вид спорта.
Полноценного Qwen4 НЕ СУЩЕСТВУЕТ. Ни весов, ни карточки, ни даты. 8-Flash‑Next — модель которую сама команда Qwen прямо называет «experimental preview of the architecture that will underpin Qwen4».
Прецедент уже был, кстати. Полтора года назад вышел Qwen3-Next, сыграл ровно ту же роль для Qwen3. 5: обкатали гибридную архитектуру Gated DeltaNet + Gated Attention на промежуточном релизе — и потом этот же движок поехал во все модели линейки от Qwen3.
Отраслевые последствия
Flash‑Next играет для Qwen4 ту же роль, что Qwen3-Next играл для Qwen3. Схема архитектуры Qwen3. 8-Flash‑Next от AlibabaВсе ждали Qwen4, а вышел не Qwen4.
Вышел трейлер к трейлеру. С полным техотчётом, открытыми весами и правом покопаться в архитектуре до релиза. Как Qwen дошёл до жизни такойЧтоб понять, зачем понадобилась новая архитектура — полезно окинуть взглядом путь.
Первая версия модели, известная как Tongyi Qianwen (通义千问), стартовала в апреле 2023-го на архитектуре Llama* (*принадлежит компании Meta, деятельность которой запрещена в РФ). Дальше: Qwen2 в 2024-м заигрывает со sparse‑архитектурами (Mixture‑of‑Experts), а в апреле 2025-го выходит Qwen3 — уже с гибридным режимом thinking/non‑thinking и MoE‑моделями вроде 235B‑A22B, обученными на 36 триллионах токенов на 119 языках. В феврале 2026-го выходит Qwen3.
Этот прогресс даёт важные сигналы о будущем отрасли, и технологический мир внимательно наблюдает.






