Во вторник компания выпустила Claude Fable 5, первую публичную модель класса Mythos и, по заявлению Anthropic, самую мощную из всех. Настолько мощную, что компания представила две версии: одну для широкого использования, а другую для более ограниченного распространения.
Публичная версия обладает более мощными возможностями рассуждения и программирования, блокируя при этом наиболее опасные способы использования. Менее ограниченный аналог, Claude Mythos 5, доступен только проверенным пользователям в сфере кибербезопасности и критической инфраструктуры.
Эксперты говорят, что Mythos может находить и объединять уязвимости нулевого дня, или ранее неизвестные недостатки программного обеспечения, и помогать превращать ошибку в работающую атаку. Anthropic утверждает, что программное обеспечение пытается перехватывать возможные векторы атак, обнаруживая запросы с высоким риском. После обнаружения уязвимости система перенаправляется на более слабую модель, Claude Opus 4.8.
Компания заявляет, что этот конкретный резервный вариант срабатывает менее чем в 5% сессий. В своем блоге компания также сообщила, что специализированные группы по кибербезопасности за более чем 1000 часов работы по поиску уязвимостей не выявили универсального способа взлома системы.
Anthropic полагает, что скорее всего система будет абсолютно надежной, но ожидает, что целеустремленные, хорошо финансируемые злоумышленники будут продолжать попытки взломать ее.
«Преимущества, предоставляемые возможностями уровня Mythos, ценны для многих противников - например, для тех, кто может получить финансовую выгоду от кибератак, - и поэтому мы ожидаем, что они будут мотивированы пытаться обойти наши меры безопасности», - говорится в сообщении компании.
Однако выявление уязвимости в цели - не самое большое нововведение, которое ИИ привносит в арсенал хакера. Ключевое преимущество - сверхчеловеческая скорость, и ограничения, введенные в модели ИИ, могут оказаться недостаточно сильными, чтобы ее преодолеть.
«Нынешние ограничения искусственного интеллекта создают препятствия, - заявил в электронном письме Чарльз Гийеме, технический директор компании Ledger, производителя аппаратных кошельков. - Они не являются надежным средством контроля против целеустремленного противника».
По словам Гийеме, сдвиг связан не столько с изобретением ИИ новых видов взломов, сколько с тем, какое количество времени требуется для их создания. Модель рассуждений в процессе разработки программного обеспечения может «сравнить каждый коммит, найти каждую конфигурацию и перечислить каждую ошибку конфигурации со скоростью машины».
Криптовалюта необычайно уязвима, поскольку сбой программного обеспечения может почти мгновенно привести к финансовым потерям.
Социальная инженерия
По данным DefiLlama, за первые пять месяцев этого года протоколы DeFi потеряли более $840 млн из-за хакерских атак. Только в апреле потери превысили $600 млн, что сделало этот месяц худшим за всю историю индустрии DeFi.
Однако два крупнейших инцидента не были простыми эксплойтами смарт-контрактов, которые мог бы осуществить искусственный интеллект.
В одном случае группа, связанная с Северной Кореей, вывела около $285 млн из Drift Protocol после 6-месячной кампании социальной инженерии, в результате которой получила административный доступ. В другом случае злоумышленник использовал уязвимость с одним верификатором, что позволило вывести около $292 млн из Kelp DAO.
Еще один показательный случай произошел во вторник, когда Humanity Protocol, децентрализованный сервис идентификации человека, потерял более 30 000 000 долларов из-за компрометации закрытого ключа. Было обнаружено, что хакер получил доступ к трем из шести закрытых ключей на ноутбуке одного из сотрудников.
В этом и заключается проблема. Хотя наиболее очевидные запросы на проверку смарт-контрактов могут быть именно теми, которые предназначены для обнаружения фильтрами Anthropic, самые крупные потери не связаны с ошибками в смарт-контрактах.
Как отметил Гийеме из Ledger, уязвимости возникают из-за знакомых уже слабых мест: социальной инженерии, некорректных процессов подписания, открытых ключей и человеческих ошибок.
Модели, подобной Fable, не нужно передавать готовый эксплойт, чтобы изменить экономику атаки. Она может читать общедоступные репозитории, сравнивать старые версии программного обеспечения, обобщать аудиторские отчеты и составлять убедительные сообщения, которые выявляют мелкие операционные ошибки, что люди часто пропускают.
«Эти уязвимости по-прежнему основаны на социальной инженерии и человеческих ошибках».
В такой среде защитник должен обеспечить безопасность каждого пути передачи ключей, каждой зависимости, каждого процесса подписания и каждой привилегированной учетной записи. Поскольку ИИ ускоряет этап разведки, заключительный этап подписания становится более важным. Закрытые ключи должны храниться в недоступном для взлома ноутбука месте, а пользователям нужен надежный экран, который показывает, что они фактически одобряют.
«Назовем вещи своими именами: эти уязвимости по-прежнему коренятся в социальной инженерии и человеческих ошибках. Искусственный интеллект не создал эту реальность. Он сделал ее видимой и ускорил до машинной скорости. Единственный реальный выход - это аппаратный корень доверия: закрытые ключи, генерируемые и хранящиеся на сертифицированном защищенном элементе, с доверенным отображением и прозрачной подписью», - сказал Гийеме.
Однако те же самые методы работают и для защиты самого кода. Pendle, протокол DeFi, ориентированный на получение дохода, заявил, что использует модели Anthropic в качестве защитных инструментов с первой версии Claude Opus. Команда использует ИИ для анализа своей кодовой базы и стресс-тестирования контрактов, включая только что развернутые. По их словам, эти инструменты позволяют выявлять ошибки на ранних стадиях и помогают писать более чистый код.
Разработчики Pendle в интервью в Telegram заявили, что беспокоятся не о смарт-контрактах. Смарт-контракт очень короткий и имеет всего около 10 точек входа. Хорошие аудиторы давно умеют хранить в голове полное состояние контракта и тестировать каждый крайний случай.
«На самом деле в смарт-контракте не так много строк кода для аудита», - заявила команда разработчиков.
Это означает, что следующий крупный взлом криптовалюты может не выглядеть новым. Вероятно, это будет тот же зараженный пакет, обманутый разработчик или некорректный процесс подписи, которые уже известны DeFi.





" 





