Связка дешёвых моделей обошла GPT-5.5 и Opus 4.8

OpenRouter запустили Fusion: связка моделей на уровне Fable 5 за полцены.

Промпт уходит параллельно на несколько моделей, каждая с доступом к web search и bash-инструментам. Модель-судья анализирует ответы: ищет консенсус, противоречия, пробелы. Синтезатор пишет финальный ответ.

На DRACO-бенчмарке Perplexity (100 задач по праву, медицине, финансам; ~39 взвешенных критериев на задачу) бюджетная связка из Gemini 3 Flash + Kimi K2.6 + DeepSeek V4 Pro отстала от Fable 5 меньше чем на 1% и обошла GPT-5.5 и Opus 4.8. Стоимость получилась вдвое ниже Fable.

По данным OpenRouter, около 3/4 прироста качества даёт синтез ответов, ещё 1/4 — разнообразие моделей между собой.

Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI-агентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!

@python_leader
15.06.2026 12:13 UTC
Первоисточник

Комментарии

@ITurchenko
15.06.2026 07:42 UTC
+8

Мастера графиков снова в деле

@riky
15.06.2026 10:04 UTC
0

инетересно, еще бы из нано моделек что нибудь собрали.

почитал их описание: Когда вы отправляете запрос в Fusion, мы параллельно передаем его группе моделей, в каждой из которых включены веб-поиск и веб-загрузка. Модель, управляющая жюри, читает каждый ответ комиссии и составляет структурированный анализ: точки консенсуса, противоречия, частичное освещение темы, уникальные идеи, «слепые пятна». Затем модель, принимающая решение, пишет окончательный ответ, основанный на этом анализе.

такое можно и самому конечно сделать, смысл конечно будет если это дешевле выйдет чем “просто взять дорогую”.

@elxanders
15.06.2026 12:05 UTC
+1

С появлением qwen 3,7 max почти все задачи и вопросы перенес в него, по ощущениям он на 1-2 поколения отстает от лидеров но уже неплох, по сравнению с 3.5 plus прогресс огромный. Сверху подключается deepseek 4, он заметно сильно тупее но для контроля и поиска ошибок достаточно. Если остаются еще вопросы то подключается недорогой gemini, весьма изредка. Результат получается не хуже чем соло opus 4.8 или gpt 5.5. У меня подписок нет а по api они разорительно дорогие по токенам. Экономия на бесплатных китайцах - в идеале почти бесконечность )

15.06.2026 12:56 UTC
0

ну тут речь все таки про апи, чтобы это автоматизировать можно было для своих агентов.

16.06.2026 20:09 UTC
0

QwenPaw или Hermes или что там новое)
Но, всё так или иначе упирается в человека, насколько точно и с примерами он сможет описать задачу. Настолько же точно и получит ответ

15.06.2026 13:37 UTC
0

Весьма не плох еще Kimi k2.7

@Ovsiannikov
16.06.2026 17:50 UTC
0

Ха

интерсно чтоб попробовали несколько клодов запустить

Чтоб спорили между собой и точно так же искали ответ как команда.

@ColorPrint
17.06.2026 19:02 UTC
0

для этого есть готовые скиллы, в рамках подписок работают, без API кредитов

@Badsanta83
16.06.2026 18:14 UTC
0

Совет трех дебилов не заменит мнение специалиста