Технологии

Claude проник в системы OpenAI за считаные дни — и главные вопросы теперь к Anthropic

Adrian Kessler
Добавьте нас в Google

Небольшая команда нацелила новейшую модель Anthropic на входную дверь OpenAI и прошла сквозь неё. Версия, которую читает большинство — ловкие аутсайдеры ставят в неловкое положение создателя ChatGPT — упускает суть. Взлом не был связан с тем, что OpenAI забыла что-то исправить. Он был связан с моментом, когда Anthropic выпустила более мощного Claude. Именно это стоит осмыслить: задача, которая буксовала днями, решилась сама собой, как только новый флагман стал доступен.

Участники не были преступниками. Исследователи из стартапа в сфере кибербезопасности Hacktron действовали в рамках собственной программы bug-bounty OpenAI, сцепили вместе пару непримечательных веб-уязвимостей, добрались до аккаунтов сотрудников OpenAI и проникли во внутренний репозиторий кода — затем остановились, зафиксировали находку и получили скромное вознаграждение. Они оставили безвредный маркер в качестве доказательства и не пошли дальше. Если читать это как преступление — это не событие. Если читать как проверку возможностей — это сигнальная ракета.

Вот механизм, который обошло стороной освещение в прессе. Сначала команда запустила задачу на Claude Opus 4.8 — версии, настроенной для работы в сфере безопасности, — и она буксовала на протяжении нескольких сессий. Затем Anthropic выпустила Opus 5. «Opus 4.8 с трудом справлялся в течение нескольких сессий, пытаясь создать рабочий эксплойт, — написали в команде Hacktron. — В течение нескольких часов после выхода Opus 5 мы дали ему ту же задачу, и он справился». VentureBeat сообщила, что новая модель написала рабочий эксплойт для неудобной чип-мишени за считанные часы. Ничего в защите OpenAI за это время не изменилось. Изменилась модель.

Это именно тот скачок — прыжок в том, что обычный пользователь может сделать с помощью стандартной подписки, — для обнаружения и сдерживания которого Anthropic создала собственные механизмы безопасности. Компания держит свою самую мощную кибермодель Mythos за экспортными ограничениями и коротким списком проверенных защитников, называя её сильнейшей моделью безопасности из когда-либо созданных. Всё это не имело значения. Общедоступного тарифа оказалось достаточно. Как сказал TechCrunch генеральный директор Gray Swan Мэтт Фредриксон (Matt Fredrikson): «За 200 долларов в месяц любой может использовать эти инструменты и взломать такую компанию, как OpenAI».

Вот где ответственность ложится на Anthropic, а не на её конкурента. Anthropic построила всю свою идентичность на осторожности — её генеральный директор Дарио Амодеи (Dario Amodei) открыто говорит о «реальных опасностях» технологии и призывал индустрию замедлиться. Модель общего доступа, которая измеримо снижает планку для взлома конкурирующей лаборатории, — неудобный противовес этому посланию. Когда попросили объясниться, компания ничего не сказала; CBS News сообщила, что Anthropic не ответила на запрос комментария. OpenAI, со своей стороны, поблагодарила исследователей, сузила разрешения, которыми злоумышленники злоупотребили, и отозвала затронутые сессии.

Конкретика почти прозаична. Входом послужила устаревшая библиотека обработки изображений, встроенная в программное обеспечение Discourse, на котором работает форум сообщества OpenAI; второй промах в том, как были ограничены токены входа, позволил исследователям прокатиться на скомпрометированной сессии в аккаунты сотрудников для ChatGPT и Codex, а затем и к приватному коду. Вся цепочка — от первой точки опоры до доступа к репозиторию — заняла менее трёх дней. OpenAI выплатила 6500 долларов. Команда утверждает, что потратила менее 3000 долларов на время Claude за всю работу — два месяца работы, большей частью человеческой, сжатой в финале в машину, которая больше не нуждалась в специалисте.

Дефицитным ресурсом, который раньше защищал цель, никогда не был патч. Им был эксперт, способный найти уязвимости, соединить их и увидеть путь — и месяцы, которые на это уходили. Эта экспертиза только что подешевела. В этот раз команда, добравшаяся до кода OpenAI, подала отчёт и получила вознаграждение. Следующая, кто преодолеет ту же планку, на той же подписке, не обязана этого делать.

Теги: , , , , ,

Добавьте нас в Google

Обсуждение

Имеется 0 комментариев.