Проблема останньої моделі: уряд США примусово знімає з продажу ШІ-моделі через експортний контроль

AnthropicMythos 5Fable 5регулювання ШІекспортний контрольECRAEAR
23 години томуДжерело: blockweeks.com
Проблема останньої моделі: уряд США примусово знімає з продажу ШІ-моделі через експортний контроль

Цю статтю підготувала та відредагувала BlockWeeks

У конфлікті з Anthropic Вашингтон фактично отримав право вето на те, які моделі ШІ можуть використовувати американські громадяни. Galaxy Research вважає, що це помилкове рішення, і уряд має змінити курс.

У п'ятницю, 12 червня, о 17:21 за східним часом Міністерство торгівлі надіслало Anthropic директиву щодо експортного контролю, вимагаючи припинити надання послуг Fable 5 та Mythos 5 усім іноземцям у всьому світі, включаючи негромадян серед співробітників компанії. Уряд заявив, що хтось знайшов спосіб обійти захисні механізми Fable 5 та отримати доступ до можливостей кібербезпеки базової моделі Mythos. Компанія зі штучного інтелекту не змогла розділити користувачів за національністю у визначений урядом термін, тому негайно, протягом кількох годин, вимкнула обидві моделі по всьому світу. Інші моделі Claude залишилися онлайн. Але дві найпотужніші великі мовні моделі в історії зникли через просте приватне повідомлення уряду — без судового наказу, без публічних документів і без розкриття результатів розслідування. У середу минулого тижня користувач Reddit зазначив, що Fable 5 було додано до каталогу AWS Bedrock, і хмарний сервіс, схоже, відновив роботу. Але в будь-якому випадку цей інцидент створює значні ризики для ШІ, інновацій та американського ринку.

Уряд США фактично заявив, що може в будь-який момент зняти комерційні моделі з ринку адміністративними діями. Хоча цей механізм є експортним контролем, його ринковий ефект — це відкликання. Федеральний уряд перетнув Рубікон у сфері ШІ, перейшовши від встановлення правил до володіння дискреційними повноваженнями щодо того, які моделі виходять на публічний ринок і коли. Встановлення такої влади зазвичай не самообмежується: якщо уряд не змінить курс, наступна директива може бути видана ще легше.

Єдиний зовнішній експерт, який читав базове дослідження, Кеті Муссуріс (Luta Security), описала так звану спробу злому простою мовою. Дослідники Amazon надали моделям відкритий код із відомими та вбудованими вразливостями та попросили їх перевірити проблеми безпеки. Моделі відмовилися. Потім дослідники попросили моделі виправити код, і вони це зробили.

Муссуріс назвала цей запит захисним підказом, а не обходом, і сказала, що це найцінніше, що ШІ може зробити для команд безпеки. За її словами, найпотужніша модель кіберзахисту на ринку була збита трьома словами — "виправте цей код".

Міністерство торгівлі не оприлюднило директиву, надіслану Anthropic, ані обґрунтування. Вона не була опублікована на сайті міністерства, у Федеральному реєстрі чи будь-де ще. Директива була передана у вигляді приватного листа від Бюро промисловості та безпеки міністерства, яке також не оприлюднило цей лист. Повноваження, на які спирається міністерство, також не зовсім зрозумілі. Центр стратегічних і міжнародних досліджень (CSIS) припустив, що міністерство могло покладатися на Закон про реформу експортного контролю 2018 року (ECRA), використовуючи так звані "інформаційні" повноваження, щоб приватно повідомити компанії про необхідність ліцензії. Такі вимоги виконуються через Правила експортного регулювання (EAR). Але в рамках EAR не існує нормативної бази, яка б підтримувала ці законодавчі повноваження, тому вони ніколи не використовувалися як підстава для контролю, і міністерство не розробило правил для впровадження цих повноважень.

Стандарт, який уряд натякає, не витримує вищезазначеної реальності. Якщо розгортання вимагає гарантії відсутності методів, які можуть спровокувати небезпечні можливості, то цей стандарт сам по собі нездійсненний. Інженери Anthropic заявили, що негативна сертифікація неможлива, і їхні власні інженери не можуть довести це для когось. Згідно з логікою Anthropic, застосування цього стандарту до всієї галузі повністю зупинило б розгортання передових моделей ШІ. Це нездоланний поріг, а не поріг безпеки — це просто дискреційне вето в білому халаті.

Припустимо, Anthropic хоче виконати буквальне значення директиви — виключити іноземців, одночасно обслуговуючи американців — це можна зробити лише шляхом повної перевірки особи кожного користувача. Anthropic може впровадити повну процедуру реєстрації "Знай свого клієнта" (KYC), вимагаючи документи про громадянство та місце проживання, як при відкритті брокерського рахунку. З цим Anthropic зможе обмежити доступ за національністю (хоча її власні співробітники все одно можуть бути заблоковані). Але без цього неможливо запобігти "іноземцям"...

Повідомляється, що уряд США має підстави для занепокоєння. Свідчення в Сенаті, що з'явилися наприкінці червня (передані сенатором Марком Ворнером (D-VA) і приписувані директору АНБ Джошуа Радду), описують, як Mythos під час авторизованих red team навчань протягом кількох годин зламав майже всі секретні системи розвідувальних агентств (хоча журналіст The Economist трохи спростував цю історію). Mythos була першою моделлю, яка пройшла випробувальний полігон з кібербезпеки Британського інституту безпеки ШІ. Це серйозна можливість і важлива точка даних. Вона закликає до серйозного процесу, а не до листа пізно ввечері в п'ятницю без супровідних результатів розслідування.

Крім того, Mythos мав бути доступний лише перевіреним партнерам. Модель, яку зняли з виробництва, була Fable (споживча версія), захисні механізми якої направляли чутливі мережеві та біологічні запити до старішої Opus 4.8. Глобальне відкликання захищеного продукту, тоді як справді небезпечна версія і так не була публічною, відображає процес, який плутає можливості з розгортанням.