DeepSeek-V3.2-Exp: китайцы снова мутят что-то хитрое

DeepSeek выпустили экспериментальную модель DeepSeek-V3.2-Exp — видимо, промежуточный шаг к их следующему «монстру». Главное новшество — DeepSeek Sparse Attention: хитрый способ сделать работу трансформеров на длинных текстах быстрее и дешевле.

Если по-простому: модель учится «не тратить внимание впустую». Вместо того чтобы пересчитывать все связи между словами, она обрабатывает только важные — и при этом почти не теряет качество ответа. Бенчмарки показывают, что результат остался на уровне прошлой версии V3.1, но вычислительная эффективность заметно выросла.

На фоне этого в таблицах видно забавную деталь: где-то V3.2 чуть просела (например, Humanity’s Last Exam), а где-то подросла (AIME 2025, Codeforces). Короче, стабильность качества при ускорении — звучит как «мы тихо оптимизируем и готовим что-то большое».

Benchmark

DeepSeek-V3.1-Terminus

DeepSeek-V3.2-Exp

Reasoning Mode w/o Tool Use

MMLU-Pro

85.0

85.0

GPQA-Diamond

80.7

79.9

Humanity's Last Exam

21.7

19.8

LiveCodeBench

74.9

74.1

AIME 2025

88.4

89.3

HMMT 2025

86.1

83.6

Codeforces

2046

2121

Aider-Polyglot

76.1

74.5

Agentic Tool Use

BrowseComp

38.5

40.1

BrowseComp-zh

45.0

47.9

SimpleQA

96.8

97.1

SWE Verified

68.4

67.8

SWE-bench Multilingual

57.8

57.9

Terminal-bench

36.7

37.7

Ну и да, всё это open source: можно уже потыкать на Hugging Face, запустить через vLLM или SGLang (докер-образы готовы).

Похоже, DeepSeek делает ставку на то, чтобы длинные контексты стали дешевле и быстрее. А значит — впереди, возможно, совсем другие масштабы для ИИ-агентов и RAG-систем.

Источник | Hugging Face

Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI-ассистентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!

@python_leader
29.09.2025 16:40 UTC
Первоисточник

Комментарии

@Dreaming
29.09.2025 12:34 UTC
+2

DeepSeek получает в Китае просто потрясающую поддержку на всех уровнях, включая гос.
Мне кажется уже каждый китаец знает, что это такое и его развивают всем селом.

@AC_74
29.09.2025 14:39 UTC
+2

Жалко в России не так. У нас только выдавливать умеют и запрещать, вместо поддержки и помощи

29.09.2025 14:48 UTC
+3

В Китае тоже запрещать умеют неплохо. Просто у них ещё лет 5 назад в год защищалось больше 5 тысяч кандидатов наук по машинному обучению и науках о данных. И зарплаты у постдоков раза в 4 выше.

А так, DeepSeek - "галера с гос номерами", там пашут.

29.09.2025 14:56 UTC
+3

Речь про бизнес запреты. Я не злорадствую. Грущу, понимая, что РФ могла бы занять свою часть в этом хайпе с ИИ - возможности и ресурсы имеются.

30.09.2025 06:10 UTC
+1

Боже мой, бедные джет брейнсы, яндексы, касперские и ещё куча других контор, которые выросли в рф. Успех вопреки, а не благодаря помощи государству!

30.09.2025 06:18 UTC
+1

Ну это смешные примеры. Хоть одна из них лучше зарубежных аналогов, с которых срисована? Какой успех вопреки, если это не инновационные продукты и компании, вы читали контекст или лишь бы ляпнуть? И не сказать, что успешные примеры. У Яндекса получилось. Но там больше не айти, а сильный российский ретейл зарешал.

30.09.2025 15:47 UTC
+2

Простите, а с кого из зарубежных аналогов срисован Касперский и Джетбрейнс, не лучшим аналогом которого является?

30.09.2025 15:50 UTC
+1

Eclipse/Borlands...

MacAfee/Norton...

01.10.2025 20:30 UTC
0

Eclipse, Borlands - даже не смешно)

MacAfee, Norton - не припомню я, чтобы там был опенсорс какой-то, чтобы его можно было "слизать"

@Vilos
30.09.2025 05:23 UTC
0

Кстати DeepSeek очень хорошо понимает русский язык, много лучше чем другие зарубежные LLM.

30.09.2025 11:05 UTC
+2

Скажем, он его ещё лучше понимал, пока на отечественные китайские видеокарты справки не перенесли. Теперь в ответах то и дело английские слова вставляет, и ещё не признаёт, что это не норма (ну, всё llm оправдывают свои косяки, конечно).

На днях довелось с Gemini последней пообщаться, правда недолго из-за ограничений, но был приятно удивлён. Намного интереснее само общение получилось. Deepseek - это как жена, а Gemini - любовница.

30.09.2025 16:25 UTC
+2

Читал ваш комментарий с электропочты, но прочтя его решил зайти на Хабр, что бы плюсануть его. Сравнение с женой и любовницей - такого я еще не слышал, однозначно плюсик :) Я вот Gemini не пользовался, поэтому сложно сказать какова она в качестве любовницы, а то что DeepSeek - жена, согласен полностью; понятливая, добрая, и....немного туповатая, зато красивая и любимая.

Анекдот в тему:

Спросите у любой женщины чьи губы слаще мужа или любовника, и любая ответит что мужа; и тот же вопрос задайте мужчине - он ответит "незнаю", потому что это правильный ответ жене :)

@Axelaredz
30.09.2025 11:39 UTC
+1

но..
Qwen на практике их обходит по всем сферам использования

30.09.2025 15:52 UTC
0

Gwen гораздо хуже Grok/GeminiPro... Причём почти во всех задачах.

Просто он дешевле, а так не понимаю зачем ещё и китайский продукт выбирать, если есть доступ к другим

30.09.2025 20:13 UTC
+1

Не везде можно использовать закрытае модели. Где-то можно только открытые и на своём оборудовании. А Deepseek не помещается в 1 видеокарту с не самым большим объёмом памяти. Для этих целей хорошо подходит Qwen3 он есть во множестве различных размеров и показывает хорошие результаты среди открытых моделей. И Gpt-Oss недавно вышедший от OpenAI ещё не плох в нескольких задачах.

01.10.2025 09:55 UTC
0

Вы прослушали наверно, я говорю на реальном примере вариант Gemeni CLI https://google-gemini.github.io/gemini-cli/, который в виде расширения для форков VSCode, проиграл уйдя в рекурсию исправляя сам себя)

На этой же задаче Qwen 3 Coder plus https://qwenlm.github.io/qwen-code-docs/ru/, который тоже в виде расширения, справился с первого раза без ошибок

Оба бесплатные с лимитом, работают через API
Лимита который выделяется каждый день вполне достаточно чтобы сделать что то сложное

А если даже бесплатный вариант оказался хуже, чего ждать от платного

01.10.2025 12:09 UTC
0

Вероятно, плохой запрос и неверные вводные. У меня GeminiCLI уделывает GWEN, особенно в крупных проектах. Но он гораздо лучше работает на модели ПРО и при оплате токенов (неожиданно). Но использовать бесплатные продукты для программирования - это забавно с учётом стоимости подписок около 20$ и другим уровнем качества. Попробуйте Claude, Codex, Grok с подпиской или в Cursor/Windsurf...