Qwen 3.5 Medium — серия средних моделей, которые бьют прошлый флагман

Неделю назад Alibaba выпустила Qwen3.5-397B-A17B — флагман линейки. Сегодня вышли модели поменьше, и цифры у них интересные.

Все модели построены на hybrid architecture: Gated Delta Networks (линейное внимание) + sparse MoE. 3 из 4 слоёв используют линейное внимание, что даёт серьёзный прирост в скорости на длинных контекстах. В 3.5 серии Alibaba перешла на эту архитектуру целиком, и разница видна — Qwen3.5-397B декодирует в 7.2 раза быстрее, чем Qwen3-235B при контексте 256K.

Все модели мультимодальные (текст + картинки через early fusion). Все модели под Apache 2.0.

Отдельно выложили Qwen3.5-35B-A3B-Base — версия без файнтюна, для кастомного дообучения.

Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI-ассистентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!

@python_leader
25.02.2026 01:20 UTC
Первоисточник

Комментарии

@jarkevithwlad
24.02.2026 20:37 UTC
0

для кода лучше чем qwen 3 coder next 80b ?

@Politura
24.02.2026 22:12 UTC
+1

В теории да, qwen 3 coder next 80b набирал 68% в swe bench verified, но как там на практике, надо смотреть. 122B версия точно должна быть лучше, 27B dense может тоже, но наверняка слишком тормозная для реального кодинга, 35B врядли лучше, слишком мало времени прошло после релиза qwen 3 coder next 80b чтоб модель в 2 раза меньше размером стала действительно лучше.

25.02.2026 05:10 UTC
0

месяц назад пытался заставить этот квен откусывать от С файла куски такие чтобы они не содержали незаконченных выражений с целью минизировать контекст для дальней генерации из этих кусков байндингов на хаскел. Так вот даже с такой задачей ничего путного не вышло.

26.02.2026 14:26 UTC
0

Звучит как очень простая задача. Может веса переквантованные были.

25.02.2026 06:23 UTC
+2

Qwen3.5-27B-Q3_K_S.gguf на rtx 3090 выдаёт 27ток/с (128к контекста в vram), при этом у меня Qwen3-Coder-Next-IQ4_XS.gguf выдаёт 33ток/с (256к контекста в vram)

@Chudoyudin
25.02.2026 08:59 UTC
+1

Модель 27B, а параметров 27 млрд.

@Vladyslav_Ponpm
25.02.2026 11:09 UTC
+1

реально???

@Kejma
25.02.2026 15:51 UTC
+1

Как вы это поняли??

@Klimovskii
25.02.2026 13:59 UTC
0

3 max для текстов все ещё топ

@AlexanderAnisimov
26.02.2026 14:46 UTC
0

А на флэш есть где-то бенчмарки?

модель есть - а бенчмарки на нее где?
модель есть - а бенчмарки на нее где?