Claude нашел новые слабости в двух криптографических схемах
Anthropic представила результаты исследования, в котором предварительная версия модели Claude Mythos применялась для поиска слабых мест в криптографических алгоритмах. Криптография лежит в основе защиты цифровых данных: одни алгоритмы позволяют подтверждать личность и подлинность сообщений, другие шифруют информацию так, чтобы ее не могли прочитать посторонние. В ходе эксперимента модель обнаружила ранее неизвестные способы атаковать схему цифровой подписи HAWK и специальную ослабленную версию шифра AES.
Первый результат касается HAWK — экспериментальной схемы цифровой подписи, рассчитанной в том числе на угрозу со стороны будущих квантовых компьютеров. Цифровая подпись математически подтверждает, что сообщение или документ действительно отправлены владельцем определенного ключа и не были незаметно изменены. По данным Anthropic, HAWK на протяжении двух лет анализировали специалисты, однако Claude Mythos Preview потребовалось около 60 часов, чтобы найти неизвестную ранее атаку, вдвое снижающую заявленный уровень криптографической стойкости схемы.
Второе исследование было посвящено урезанной версии AES — широко известного стандарта симметричного шифрования. При симметричном шифровании один секретный ключ используется и для преобразования данных в закрытый вид, и для их последующего восстановления. Полноценный AES десятилетиями изучается криптографами и относится к числу наиболее тщательно проверенных алгоритмов. Но в эксперименте использовался не полный стандарт, а его намеренно ослабленный исследовательский вариант. За одну неделю Mythos Preview нашла способ ускорить атаку на этот вариант в 200–800 раз.
Ни один из двух результатов не означает, что используемые сегодня системы защиты оказались взломаны. HAWK пока остается предлагаемой схемой и, согласно сообщению Anthropic, нигде не внедрена. Работа с AES затрагивает сокращенную версию алгоритма и не позволяет взломать его полноценную конфигурацию. Поэтому исследование не создает непосредственной практической угрозы действующим сервисам, устройствам или зашифрованным данным.
Особенность эксперимента состоит в высокой степени самостоятельности модели. Anthropic утверждает, что Mythos Preview выполнила основную часть исследовательской работы автономно и лишь изредка получала подсказки от человека. При этом вычислительная цена была значительной: каждый из двух результатов обошелся примерно в 100 тысяч долларов расходов на API. Такой уровень затрат пока ограничивает массовое применение подобного подхода, но одновременно показывает, какой объем сложной интеллектуальной работы можно выполнить при предоставлении модели достаточных ресурсов.
До публикации Anthropic заранее уведомила авторов исследованных алгоритмов, а также партнеров в правительстве США. Такой порядок раскрытия нужен, чтобы разработчики и заинтересованные организации могли изучить найденные слабости до того, как технические подробности станут общедоступными. Компания опубликовала отдельные материалы с полным описанием атак на HAWK и урезанный AES, а также связанную запись цепочки рассуждений модели для исследования AES.
Авторы рассматривают результаты как свидетельство того, что современные передовые модели способны выполнять отдельные криптографические исследования на экспертном уровне. Практическая защитная ценность таких систем может заключаться в дополнительной проверке новых алгоритмов до их внедрения. Модель может перебирать исследовательские гипотезы, искать нестандартные связи и помогать специалистам обнаруживать ошибки в механизмах, от которых зависит конфиденциальность онлайн-коммуникаций и данных.
Одновременно эта способность имеет двойственный характер: инструмент, умеющий находить уязвимости для их исправления, потенциально может применяться и в наступательных целях. Само сообщение Anthropic сосредоточено на исследовательских и защитных возможностях, а отсутствие влияния на действующие системы снижает непосредственный риск именно этих двух работ. Тем не менее результаты показывают, что оценка возможностей ИИ в криптоанализе становится самостоятельной задачей безопасности.
Для более систематического измерения этих возможностей Anthropic совместно с исследователями ETH Zurich, Тель-Авивского университета и Университета Хайфы создала CryptanalysisBench. Это эталонный набор испытаний, предназначенный для проверки того, насколько успешно большие языковые модели справляются с задачами криптоанализа — поиска слабостей в шифрах и других защитных математических конструкциях. Исследование переводит обсуждение ИИ в криптографии от отдельных демонстраций к измеримым тестам, позволяющим сравнивать модели и отслеживать рост их возможностей.
Почему это важно
- —Claude продемонстрировал способность самостоятельно решать сложные задачи криптоанализа на уровне экспертного исследования.
- —ИИ может стать дополнительным инструментом проверки криптографических алгоритмов до их внедрения в реальные системы.
- —CryptanalysisBench позволит системно измерять развитие возможностей языковых моделей в поиске криптографических слабостей.
Ключевые факты
- Mythos Preview за 60 часов нашел атаку, вдвое снижающую стойкость экспериментальной схемы цифровой подписи HAWK.
- За неделю модель ускорила атаку на урезанную версию AES в 200–800 раз, но не взломала полноценный стандарт.
- Большую часть работы модель выполнила автономно; каждый результат потребовал примерно 100 тысяч долларов расходов на API.
- HAWK нигде не внедрена, поэтому найденные атаки не затрагивают используемые сегодня системы.
- Anthropic заранее сообщила о результатах авторам алгоритмов и партнерам из правительства США.
Полный текст — в первоисточнике. Здесь — краткое изложение и ключевые факты.