Anthropic открыли доступ к Code Review: команда агентов на каждый PR

Anthropic запустили ревью кода через агентов — и это уже работает на их собственных PR.

Когда разработчик открывает pull request, Code Review автоматически запускает команду агентов. Они параллельно ищут баги, потом фильтруют ложные срабатывания и ранжируют проблемы по серьёзности. На выходе — один общий комментарий к PR и отдельные инлайн-замечания по конкретным местам. Время обработки в среднем около 20 минут.

Anthropic запустили эту фичу внутри раньше, чем анонсировали. До внедрения Code Review содержательные комментарии получали только 16% PR, после — целых 54%. Code Review берёт разбор кода на себя и выдаёт список конкретных проблем, так что ревьюер смотрит на готовые результаты, а не сканирует диф с нуля. Судя по цифрам, такой подход дал значительные результаты.

Один из реальных кейсов: однострочное изменение в продакшн-сервисе выглядело рутинно, но Code Review пометил его как критическое. Изменение сломало бы аутентификацию сервиса — и это поймали до мёржа. Другой случай — у клиента в open-source проекте TrueNAS агенты нашли баг в соседнем коде, который PR даже не трогал: type mismatch тихо сбрасывал кеш ключей шифрования при каждой синхронизации.

Стоит это дороже, чем существующий GitHub Action от Anthropic (он по-прежнему бесплатный и open source). Средняя цена ревью — $15–25, масштабируется с размером PR.

Функция доступна в research preview для Team и Enterprise планов.

Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI-агентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!

@python_leader
10.03.2026 00:56 UTC
Первоисточник

Комментарии

@HRYN
09.03.2026 20:23 UTC
+5

Ну блин, $15-25 за ревью это конечно... но с другой стороны если считать сколько стоит час нормального разраба который реально смотрит а не тупо апрувит - может и окупается.

@powerman
09.03.2026 21:40 UTC
+8

Время обработки в среднем около 20 минут.

$20 за 20 мин. это $60/час. Никому не нужен ИИ работающий по цене топового спеца но при этом ни за что не отвечающий и выдающий результат на уровне крепкого миддла в лучшем случае.

09.03.2026 21:50 UTC
+2

Это было бы валидно, если б ИИ работал полный день как топовый специалист. Тут же он работал 20 минут, и это полный цикл.

09.03.2026 21:52 UTC
+2

Это валидно, потому что за эти деньги можно оного спеца нанять ревьювить те же PR на почасовке.

10.03.2026 09:29 UTC
0

Серьезно? Можете нанять человека, который потратит кучу времени на погружение в продукт, а потом фултайм будет заниматься ревью?

10.03.2026 12:37 UTC
0

Серьёзно. Пока речь о 3-х PR-ах в месяц абсолютно без разницы сколько стоит сделать ревью. У меня ревью (обучающие) и по 2 часа на PR занимали, но можно в среднем взять упомянутые в статье пол часа. Это 16 PR-ов в день максимум, реально скорее 10. 10 PR-ов в день вполне в состоянии производить компания очень скромного размера. И вот уже мы имеем полноценный фултайм для такого сотрудника.

13.03.2026 15:40 UTC
0

Я не про количество, а про то, что вы наймете человека, который будет кайфовать от ревью.

в реальности вы наймете 1 человека, который возьмет на себя N% нагрузки.

Потом вы начнете дробить продукт.

Я прекрасно понимаю всю экономику этих процессов.

20$ за ревью любого крупного MR/PR - это отличный дополнительный инструмент, если он работает.

09.03.2026 23:51 UTC
0

Очень хороший спец на зарплате в России стоит тысяч 700 в месяц. С офисом, налогами и кофем с ДМС.

Это тысяч 5 в час. Примерно с округлением вверх с учетом перерывов на кофе. Полчаса на ревью от хорошего спеца который отвечает за свою работу сравнимо с ценой сетки которая ни за что не отвечает и галлюцинирует. Бюджет не сходится.

10.03.2026 00:36 UTC
0

Вы неправильно считаете. Сетка за полчаса весь проект перечитает раз 10. Что сделает "спец" за полчаса?

опять же вопрос цены ошибки. Если у вас фича выкатывается на 1млн пользователей, и простой даже 5ти минут вам может стоить много много денег. То любой доп инструмент проверки "спецов", которые не выспались, ударили мизинчик и тд - пойдёт.

К тому же это траты на ПО, а не на человеков. Думаю можно позволить себе тратить цену одного разраба, если он будет критические PR (критичных сервисов) по всей компании проверять.

10.03.2026 00:59 UTC
0

Вы неверно ставите и оцениваете задачу. Не надо читать проект 10 раз. Надо оценить PR. И выдать разрешение его вливать или написать обоснованные претензии к нему. С учетом контекста, продукта, планов, техдолга и всего-всего.

Критические штуки надо проверять и сеткой (а лучше парочкой) и человеком (и тоже лучше двумя). С решениями за человеком или консенсусом из пары человек. Ничего не имею против.

Вопрос про обычный бизнес код. Его проверять сеткой за такие деньги дорого. А челоеком все равно придется. Значит стоит оставить только человека.

10.03.2026 05:47 UTC
0

Если уж за математику, то предлагаю подумать ещё вот о чем. Весь этот AI;DR на качестве как они заявляют в 50% (а у нас такого конечно же не получится), заставляет потом человека тратить то же самое время на чтение комментариев и возню с ними. Что выльется ровно в тот же час.

Так что дело не в деньгах, а в действительно попытке отловить регрессионные баги.

С ними правда тоже большой вопрос, пайплайн автофикса бага из сентри стоит в районе доллара. Имея качественный ci/cd и a/b деплои — вполне можно обойтись этим, а кожаные стерпят.

10.03.2026 09:41 UTC
0

20$ на API даже для Claude и 20 минут его работы, это очень большой объем работы. Он не просто читает PR, и делает суммаризацию по нему (Потому что это конкретное действие иногда и двух центов не стоит).
Вероятнее всего Claude поднимает субагентов которые перечитывают и тестируют всю кодовую базу с конкретной фичей, вероятно он еще и сам поднимает и тестирует этот код. Именно по этому там PR может обходиться в 20$. Так что тут мы получаем целую команду нейросетей за эти деньги.

Лично я доверяю Claude больше, чем многим людям вокруг.

10.03.2026 12:42 UTC
+1

Лично я доверяю Claude больше, чем многим людям вокруг.

И совершенно зря. Уровень Claude при работе с кодом очень высок - по сравнению с остальными AI. Но относительно людей - это уровень крепкого миддла. Есть очень много людей с гораздо более высоким уровнем. А если такие люди ещё и помощью Claude воспользуются, то результат будет в разы лучше, чем то, что Claude способен сделать самостоятельно.

09.03.2026 21:58 UTC
+1

Думаю, они на рынок США нацелены сейчас, а там такая цена может пойти.

10.03.2026 02:59 UTC
0

Если это для США/Калифорнии, то за $60 в час вы вообще никого не найдете. Какой-нить контрактор из Индии будет стоить 200-250+ и заниматься этим несколько часов.

10.03.2026 18:15 UTC
-1

Ох уж эти спецы программисты топящие за ручной труд

@Kaluchi
09.03.2026 23:33 UTC
+4

Кажется, что в Anthropic всем навязали KPI на медиаприсутствие. Вместо того, что бы фиксить 5500+ багов в своем Claide Code (на самом деле их гораздо больше - просто они закрываются автоматически) -- их контора фокусируются на cоздании разных хелло-вордных MVP, лишь имитирующих развитие и дающих повод о себе напомнить.

@Ilusha
10.03.2026 09:32 UTC
0

Баги из Claude code не сильно мешают пользоваться. Да, неприятно. Но остальные - хуже или такие же.

Поэтому стратегия «быть на уровне остальных» в одной части продукта, но быть впереди остальных в другой вполне себе верна

@play_to
11.03.2026 06:48 UTC
0

Искренне верю, что деньги/польза у bugbot от cursor намного лучше