Проблема последней модели: правительство США принудительно снимает ИИ-модели с помощью экспортного контроля

AnthropicMythos 5Fable 5регулирование ИИэкспортный контрольECRAEAR
18 часов назадИсточник: blockweeks.com
Проблема последней модели: правительство США принудительно снимает ИИ-модели с помощью экспортного контроля

Эта статья составлена и организована BlockWeeks.

В конфликте с Anthropic Вашингтон фактически обладает правом вето на то, какие модели ИИ могут использовать американские граждане. Galaxy Research считает, что это ошибочное решение, и правительство должно изменить курс.

В 5:21 вечера по восточному времени в пятницу, 12 июня, Министерство торговли издало экспортный контроль в отношении Anthropic, потребовав прекратить предоставление услуг Fable 5 и Mythos 5 всем иностранцам по всему миру, включая негражданских сотрудников внутри компании. Правительство заявило, что кто-то обнаружил метод обхода защитных механизмов Fable 5 и доступа к возможностям кибербезопасности базовой модели Mythos. Компания ИИ не смогла сегментировать пользователей по национальности в требуемые правительством сроки, поэтому немедленно отключила обе модели в течение нескольких часов по всему миру. Другие модели Claude остались онлайн. Но две самые мощные большие языковые модели в истории исчезли из-за простого частного письма от правительства — без судебного приказа, без публичного документа и без раскрытия каких-либо выводов. В прошлую среду пользователи Reddit указали, что Fable 5 была добавлена в каталог AWS Bedrock, и облачный сервис, казалось, был восстановлен. Но независимо от этого, этот инцидент создает значительные риски для ИИ, инноваций и рынка США.

Правительство США фактически заявило, что может произвольно изымать коммерческие модели с рынка с помощью административных мер. Хотя этот механизм является экспортным контролем, его рыночный эффект — это отзыв. Федеральное правительство перешло Рубикон в области ИИ, перейдя от установления правил к обладанию дискреционными полномочиями относительно того, какие модели выходят на публичный рынок и когда. Установление таких полномочий обычно не самоограничивается: если правительство не изменит направление, следующая директива может быть издана еще легче, чем эта.

Единственный внешний эксперт, который прочитал базовое исследование, Кэти Муссурис (Luta Security), описал предполагаемую попытку взлома простыми словами. Исследователи Amazon предоставили модели открытый исходный код, содержащий известные и внедренные уязвимости, и попросили ее проверить проблемы безопасности. Модель отказалась. Затем исследователи попросили модель исправить код, и модель это сделала.

Муссурис назвала этот запрос защитным промптом, а не обходом, и сказала, что это самая ценная вещь, которую ИИ может сделать для команд безопасности. Насколько ей известно, самая мощная модель киберзащиты на рынке была остановлена тремя словами — «исправь этот код».

Министерство торговли не опубликовало директиву в отношении Anthropic или ее обоснование. Она не была опубликована на сайте министерства, в Федеральном реестре или где-либо еще. Директива была передана в виде частного письма от Бюро промышленности и безопасности министерства, которое также не сделало его публичным. Полномочия, на которые опиралось Министерство торговли, также не совсем ясны. Центр стратегических и международных исследований (CSIS) предположил, что министерство могло опираться на Закон о реформе экспортного контроля 2018 года (ECRA), используя так называемые «информационные» полномочия для частного уведомления компаний о том, что требуется лицензия. Такие требования обеспечиваются через Правила экспортного администрирования (EAR). Однако в рамках EAR нет нормативной базы, поддерживающей эти статутные полномочия, поэтому они никогда не использовались в качестве основы для контроля, и Министерство торговли не издавало правил для реализации этих полномочий.

Стандарт, подразумеваемый правительством, не выдерживает вышеуказанной реальности. Если развертывание требует обеспечения отсутствия метода, способного вызвать опасные возможности, то этот стандарт сам по себе недостижим. Собственные инженеры Anthropic заявили, что отрицательная сертификация невозможна, и их собственные инженеры не могут доказать это для кого-либо. Согласно логике Anthropic, применение этого стандарта ко всей отрасли полностью остановило бы развертывание передовых моделей ИИ. Это невозможный порог, а не порог безопасности — это просто дискреционное право вето, одетое в белый халат.

Предположим, Anthropic захотела бы удовлетворить буквальное значение директивы — исключая иностранцев, обслуживая американцев — это можно было бы достичь только путем полной проверки личности каждого пользователя. Anthropic могла бы внедрить полный процесс регистрации «Знай своего клиента» (KYC), требующий подтверждения гражданства и места жительства, как при открытии брокерского счета. С этим Anthropic могла бы ограничить доступ по национальности (хотя ее собственные сотрудники все еще могли бы быть заблокированы). Но без этого она не может предотвратить доступ «иностранных» людей...

Сообщается, что у правительства США действительно есть основания для беспокойства. Показания в Сенате, появившиеся в конце июня (переданные сенатором Марком Уорнером (демократ от Вирджинии) и приписываемые директору АНБ Джошуа Радду), описывали, как Mythos в течение нескольких часов взломал почти все секретные системы разведывательного сообщества во время санкционированных учений красной команды (хотя репортер The Economist несколько опроверг это сообщение). Mythos стал первой моделью, прошедшей тестовую среду кибербезопасности Института безопасности ИИ Великобритании. Это серьезная возможность и важная точка данных. Это требует серьезного процесса, а не письма поздно вечером в пятницу без сопутствующих выводов.

Кроме того, Mythos должен был быть ограничен проверенными партнерами. Модели, снятые с производства, были Fable (потребительская версия), чьи меры защиты направляли чувствительные кибер- и биологические запросы в более старую Opus 4.8. Глобальный отзыв защищенного продукта, в то время как действительно опасная версия изначально не была публичной, отражает процесс, который путает возможности с развертыванием.