Claude Code снова удивляет — теперь уже в криптографии

Мы уже видели, как языковые модели решают задачки, над которыми профессора чесали головы годами. Видели, как они не решали задачу, а просто находили ответ, потому что знали, где копать (и не ленились, в отличие от нас, смертных). А теперь Claude Code от Anthropic залез в криптографию и починил реализацию постквантового алгоритма.

Инженер писал на Go реализацию ML-DSA, всё шло по плану, пока проверки не начали сыпаться с “invalid signature”.

Дальше — классика: часы дебага, кофе, отчаяние. И вот Filippo, автор кода, решает: “а пусть Claude посмотрит”. Через несколько минут LLM спокойно отвечает: 

Ты дважды взял high bits

И оказывается права. Баг нашёл не эксперт, а языковая модель.

Самое интересное — как именно Claude работал. Он вёл себя, как живой разработчик: ставил printf, гонял тесты, отслеживал неверные значения, искал закономерности. И, что важно, нашёл ошибку быстрее человека.

А под конец Filippo выдал отличную идею:

А что, если бы у нас был инструмент, который автоматически запускал LLM, когда падают тесты, и просто сообщал: “я нашёл причину”? Если модель справилась быстрее — класс, если нет — ничего страшного, продолжаем сами. Такой сценарий звучит куда реалистичнее, чем “сделай PR” или “реши задачу целиком”.

Источник

Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI-ассистентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!

@python_leader
03.11.2025 11:21 UTC
Первоисточник

Комментарии

@vened
03.11.2025 08:29 UTC
+24

> часы дебага, кофе, отчаяние.

В оригинале ничего подобного нет. В оригинале – сам разработчик пишет, что уже «был уставшим, поэтому попробовал “подебажить” полчаса и потом бросил, намереваясь вернуться на следующий день». Ну и решил, что почему бы, пока сам занят другим, не воспользоваться бесплатным купоном от Anthropic на Claude Max и не натравить на неверно работающий код LLM.

> Через несколько минут LLM спокойно отвечает

В оригинале: LLM сгенерировала некоторый «фикс», с простыми тестами, а разработчик, посмотрев на это решение, выкинул код LLM, потому что он оказался далёк от оптимального, и просто переписал соответствующие функции заново, исправив саму исходную ошибку. Однако формулировку описания ошибки – относит к результатам LLM, поскольку та сэкономила время отладки (что, в принципе, логично).

@AnruKitataze
04.11.2025 11:34 UTC
+3

Вашим комментарием AI хайп не продать, увы

Но статья, конечно... Сомнительного качества вольный пересказ, скажем мягко

@Arlekcangp
07.11.2025 06:45 UTC
0

Вот в это я поверю. Не так давно имел проблему в коде, который генерирует jpa запрос на основе внутреннего конструктора с фильтрами, сортировками и проекциями. Поимел полную опу огурцов при конвертации этого кода с hibernate criteria на jpa при переходе на шестой гибер, где старый criteria api выпилили. Так вот: после всех исправлений, код получался уродливым, отчаялся, дал код llm. Этот болван нашёл ошибку, которая ни на что не влияла и была допущена по не внимательности. В последствии я даже решил не исправлять, т к это только усложнило бы код ещё, а результат тот же... А вот как упростить код - не нашёл... Вместо этого он предложил три варианта, все из которых код ломали... В то же время с конвертацией обычных запросов без конструктора, он справился более-менее и скорее всего я бы провозился раза в три дольше руками, т к запросов было много...

Вывод какой: пока функции абстрактного мышления, синтеза и анализа в зачаточном состоянии. (Ну про то что оно не умеет развиваться, как человеческий мозг, на одиночных примерах, я на Хабре в комментариях писал много раз. Это не человек и близко. И к способностям человека в этой итерации не приблизится. Нужны ещё исследования, а они долгие и дорогие. Пузырь лопнет, не дождавшись 😁)

@Uglevod
05.11.2025 13:07 UTC
+1

А теперь кто то по дебажил игру и - "О боже, Клод код теперь профи в нейм деве"??

И да, вы уже определитесь. Или это Клод код - агент нашел ошибку ( как указано в заголовке) или это модель - как указано в тексте ( и тогда это именно может быть отмеченно в заголовке + какая именно модель - это как бы, тоже важно и желательно - с каким количеством параметров )