Вышла Claude Sonnet 4.5 – лучшая модель для программирования

Что внутри? Во-первых, модель стала лучше во всём, что связано с программированием. На бенчмарке SWE-bench Verified она теперь топ-1, а на OSWorld — выросла с 42% до 61% точности за каких-то четыре месяца. То есть Sonnet теперь не только пишет функции, но и отлично справляется с файлами, браузером и таблицами.

Помимо модели также обновили и Claude Code: завезли чекпоинты (можно откатиться, если натворил фигни), обновили терминал, прикрутили нативное расширение для VS Code. В приложении Claude теперь можно прямо в чате генерить документы, таблицы и презентации. Плюс, появился Claude Agent SDK — по сути, тот же движок, на котором Anthropic сами клепают агентов.

Antropic заявляют, что это "most aligned model yet". Другими словами, модель у Anthropic получилось неплохо побороться с галлюцинациями, манипуляциями и прочим "магическим" поведением.

Claude Sonnet 4.5 — не только самая мощная, но и самая согласованная с безопасностью из всех наших моделей. Благодаря улучшенным возможностям Claude и обширному обучению в области безопасности нам удалось существенно улучшить его поведение: снизить податливость на лесть, склонность к обману, стремление к власти и подталкивание к иллюзиям. Для агентных функций и работы с компьютером мы также значительно усилили защиту от атак через prompt injection — одной из самых серьёзных угроз для пользователей.

Цена осталась прежней: $3 за миллион input-токенов, $15 — за output. Для разработчиков модель доступна прямо сегодня в API (claude-sonnet-4-5).

Источник | Карточка модели | Модель на Openrouter

Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI-ассистентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!

@python_leader
29.09.2025 22:27 UTC
Первоисточник

Комментарии

@Dhwtj
29.09.2025 19:31 UTC
0

А я о смотрю, 4.1 резко поглупела

@MaksimMukharev
30.09.2025 04:13 UTC
0

Судя по экспериментам первым, очень уступает GPT5.

@Dhwtj
30.09.2025 11:41 UTC
0

уступает GPT5

Ага. Теперь и Opus 4.1 тоже уступает GPT5. Шаг вперёд и два назад ©

Qwen3 Max тоже силен

Может, у них тоже динамически выбираемая сложность в зависимости от нагрузки серверов? Вот, GPT 5 очень просел на старте, потом выровнялся