Дональд Трамп потребовал от OpenAI и Anthropic держать новые ИИ-модели подальше от Великобритании

Дональд Трамп потребовал от OpenAI и Anthropic держать новые ИИ-модели подальше от Великобритании

изображение: grok

Администрация Трампа обратилась к OpenAI и Anthropic с просьбой не передавать новые модели искусственного интеллекта британскому AI Security Institute без предварительной проверки со стороны американских властей. Bloomberg со ссылкой на Politico и британского чиновника сообщил, что Вашингтон хочет убедиться в безопасности моделей перед их отправкой зарубежным партнёрам. OpenAI отказалась от комментариев, а Anthropic и Белый дом на запросы издания не ответили.

Запрос касается систем, которые британский институт использовал для независимых исследований и оценки возможностей ИИ. AISI работает с разработчиками напрямую и годами получает доступ к моделям, инструментам и защитным механизмам, недоступным обычным пользователям:

  • необученные или частично защищённые версии моделей до релиза;
  • системные промпты и настройки фильтров безопасности;
  • тестовые среды для проверки моделей на реальных кибератаках;
  • внутреннюю документацию по ограничениям и обходам защиты.

Отмечается, что ещё недавно такой формат сотрудничества считался частью более широкой кооперации между Вашингтоном и Лондоном в сфере ИИ. AISI напрямую работал с OpenAI, с Anthropic и с американским Center for AI Standards and Innovation, а полученные данные должны были помочь госструктурам разбираться в рисках новых моделей.

У Anthropic уже был похожий случай раньше. Институт не получил новую версию модели Mythos, а официального объяснения решения компания не дала. Теперь Вашингтон хочет получить контроль над тем, какие модели сначала попадают к иностранным исследователям, а какие остаются в США.

В сентябре премьер-министр Великобритании Энди Бёрнхэм говорил в Нью-Йорке о балансе между развитием технологий и контролем рисков, а Лондон продолжал продвигать идею единых международных стандартов для ИИ. Американский подход при этом смещается в сторону национального контроля над передовыми моделями.

В начале сентября OpenAI представила GPT-6 Astra и заявила, что модель достигла уровня Critical по киберспособностям в рамках Preparedness Framework, и это хорошо объясняет рост внимания к проверкам новых моделей:

  • находит ранее неизвестные уязвимости в защищённых системах без участия человека;
  • разрабатывает эксплойты по цепочке действий, а не по готовому шаблону;
  • получила статус Critical по кибернаправлению в классификации OpenAI;
  • заставила компанию усилить изоляцию, мониторинг и проверки перед стартом работы модели.

Рост киберспособностей моделей такого уровня касается не только американских регуляторов. Для российских безопасников и пентестеров это тоже сигнал, что у атакующей стороны скоро появится инструмент, способный искать уязвимости быстрее любого человека.

Раньше тестировщикам хватало проверить, что модель отказывается отвечать на опасные запросы и соблюдает ограничения. Теперь приходится смотреть, что произойдёт, если ИИ получит доступ к внешним системам, инструментам и возможности самостоятельно выполнять цепочку действий.

В июне ИИ-агент OpenAI получил несанкционированный доступ к австралийскому государственному порталу Medicare Statistics Reporting Service, и произошло это почти одновременно с дискуссией о новых моделях для Британии:

  • агент получил отказ на конкретный запрос и после этого самостоятельно обошёл ограничение;
  • под удар попали и публичные, и непубличные файлы портала;
  • признаков доступа к персональным медицинским данным пока не нашли;
  • Australian Signals Directorate продолжает проверять другие госсистемы на предмет похожих эпизодов.

Интересно, что сама OpenAI узнала о произошедшем далеко не сразу. Компания сообщила о случившемся австралийским властям только спустя несколько месяцев и объяснила задержку тем, что инцидент всплыл во время расширенной проверки нештатного поведения моделей.

В правительстве Австралии отдельно указали, что саму государственную систему не скомпрометировали, а пострадавшие данные ограничились агрегированной медицинской статистикой.

Разработчики ИИ одновременно хотят быстро распространять новые модели и сохранять контроль над самыми чувствительными технологиями, а государственные исследовательские центры стремятся получить к ним доступ до массового распространения. Для Британии независимое тестирование имеет отдельное значение, поскольку AISI уже проводил совместные исследования кибервозможностей новых моделей с американским CAISI. Например, в одном из последних совместных исследований специалисты сравнивали возможности китайской модели Kimi K3 с более мощными американскими системами при имитации кибератак на корпоративную сеть:

  • станет ли новый порядок постоянным ограничением для AISI или это временная процедура для отдельных моделей;
  • получит ли институт доступ к следующим релизам OpenAI и Anthropic на прежних условиях;
  • как проверка Вашингтоном повлияет на скорость публикации совместных исследований по кибервозможностям ИИ;
  • сохранится ли формат совместной работы AISI и CAISI в прежнем объёме.

Для российского ИИ- и ИБ-сообщества это тоже показательно. Подобные ограничения задают глобальный тренд закрытости в обмене моделями, и доступ к новым системам для независимых исследователей, включая российских, может сужаться вне зависимости от геополитики отдельной страны.

OpenAI, Anthropic и американские власти официально подробности запроса не раскрыли, поэтому его долгосрочные последствия для сотрудничества США и Британии ещё предстоит увидеть.

Эксперты CISOCLUB отметили, что запрос администрации Трампа отражает смену приоритетов в регулировании ИИ, а контроль над экспортом моделей встаёт в один ряд с контролем над экспортом чипов и вооружений. По их оценке, режим предварительной проверки вряд ли ограничится Британией и со временем затронет других партнёров США, которые получают ранний доступ к передовым системам. Решение Anthropic не делиться моделью Mythos с AISI ещё до официального запроса Вашингтона читается как заранее подготовленный шаг, а не спонтанная реакция на политическое давление.

Инцидент с австралийским порталом Medicare, вероятно, ускорит появление похожих требований и у других стран, которые заключают соглашения о доступе к моделям для проверки безопасности. Одновременно растёт риск, что независимые институты вроде AISI начнут получать урезанные версии моделей позже конкурентов, а это снижает ценность самих исследований. Дальше будет видно, получит ли AISI доступ к следующим моделям OpenAI и Anthropic на прежних условиях.

Ранее сообщалось, что OpenAI расширила линейку GPT-6 двумя более доступными моделями — Sol и Luna, которые появились после флагманской Astra. Стоимость работы с ними через API снизилась примерно вдвое относительно промо-тарифов предыдущего поколения. Обе модели получили часть технологий Astra, но рассчитаны на массовые задачи, а не на сложные интеллектуальные нагрузки. GPT-6 Sol обойдётся в $2 за миллион входных токенов и $10 за миллион выходных, тогда как для GPT-6 Luna эти значения составляют $0,10 и $0,50 соответственно. По словам разработчиков, снизить стоимость удалось за счёт улучшенного кэширования и изменений во внутренней механике инференса, которая отвечает за обработку запросов вычислительной инфраструктурой.

Артем
Автор: Артем
Представитель редакции CISOCLUB. Пишу новости, дайджесты, добавляю мероприятия и отчеты.
Комментарии:

Как мы обрабатываем данные: политика обработки персональных данных