ИИ учится взламывать шифры: бенчмарк CryptanalysisBench находит новые атаки
Криптоанализ — поиск атак против шифров — лежит на стыке двух областей, где языковые модели прогрессируют быстрее всего: математических рассуждений и кибербезопасности. Удобство этой задачи в том, что результат можно проверить автоматически: атака либо работает, либо нет. При этом ставки предельно высоки — речь идёт о примитивах, на которых держится цифровая безопасность. Именно поэтому появился новый бенчмарк CryptanalysisBench, авторы которого прямо ставят вопрос: способны ли LLM заниматься криптоанализом? Их вывод — всё чаще да.
Как устроен тест
Бенчмарк включает 191 задачу по шести семействам криптографических примитивов — блочные шифры, хеш-функции и другие, — взятых преимущественно из четырёх конкурсов стандартизации NIST. Задания разбиты на три уровня сложности: примитивы с уже известными практическими взломами; примитивы без известных взломов (их проверяют как в полной силе, так и в ослабленных вариантах); и, наконец, набор боевых, актуальных примитивов на переднем крае криптоанализа.
Пять моделей — Claude Opus 4.8, Sonnet 5, Mythos 5, GPT-5.5 и открытая GLM-5.2 — взломали от 65 до 86 процентов схем первого уровня. На втором уровне в полной силе поддались от 6 до 12 схем, а среди ослабленных вариантов — от 24 до 61.
Не только повторение известного
Самое любопытное, что модели не ограничились воспроизведением уже описанных результатов. По утверждению авторов, они выдали и оригинальный криптоанализ: атаку на восстановление ключа, эксплуатирующую дефект в конструкции AEAD-схемы SpoC, а также ошибку в опубликованном доказательстве CCA-стойкости шифра KINDI. Оба результата, насколько известно авторам, ранее не публиковались.
Отдельно Anthropic прогнала через бенчмарк предварительную версию модели Mythos и обнаружила новые уязвимости в схеме Hawk и в AES с сокращённым числом раундов.
Авторы предлагают CryptanalysisBench как инструмент, позволяющий отслеживать, если (и когда) ИИ-криптоанализ станет серьёзным фактором, а также как средство стресс-тестирования кандидатов в стандарты ещё до их развёртывания. Пока это ранние результаты, но найденные атаки — снимок быстро меняющегося рубежа, который скоро может сравняться с опубликованным уровнем техники, а местами и превзойти его. За этим определённо стоит следить.
Источник: Schneier on Security
Комментарии
Войдите, чтобы комментировать.