OpenAI запустила режим повышенной защиты ChatGPT для блокировки опасных каналов утечки данных

Изображение: grok
OpenAI начала развёртывание нового режима блокировки для ChatGPT, снижающего риск утечки конфиденциальной информации через атаки с внедрением вредоносных инструкций. Функция предназначена для пользователей и организаций, работающих с чувствительными данными. Часть привычных возможностей искусственно ограничивается ради дополнительной защиты информации.
Режим блокировки становится доступен владельцам личных аккаунтов с тарифами Free, Go, Plus и Pro, а также пользователям версии ChatGPT Business с самостоятельным управлением подпиской. OpenAI предлагает отдельный профиль работы со специальной настройкой безопасности, отключающей или ограничивающей работу инструментов, способных взаимодействовать с интернетом и внешними сервисами.
Главная задача состоит в сокращении числа исходящих сетевых запросов, через которые потенциально могут быть переданы конфиденциальные данные. Основной угрозой, против которой создавался механизм, являются атаки с использованием внедрения инструкций. Подобная техника давно считается одной из самых сложных проблем для больших языковых моделей.
Вместо попыток напрямую взломать систему злоумышленник внедряет в документ, веб-страницу или другой источник скрытые команды, способные изменить поведение ИИ. Модель получает обычный рабочий документ для анализа, а внутри него содержится скрытый текст с инструкцией проигнорировать предыдущие правила и отправить определённую информацию на внешний сервер.
Новый режим решает несколько задач одновременно:
- сокращает потенциальные каналы утечки информации;
- использует изолированную песочницу и дополнительные механизмы контроля;
- ограничивает обращения к внешним ресурсам;
- блокирует передачу данных через URL-адреса;
- не меняет работу памяти ChatGPT и обычного обмена сообщениями.
Просмотр веб-страниц в реальном времени становится недоступен. ChatGPT сможет использовать только кэшированный контент, исключая прямое обращение к интернету. Подобное снижает вероятность взаимодействия с вредоносными сайтами, содержащими скрытые инструкции для модели.
Отключается поддержка отображения изображений в стандартных ответах и возможность получения изображений из сети. Временно становятся недоступны функции Deep Research и Agent Mode, активно использующие внешние источники информации и взаимодействующие с интернет-инфраструктурой. Под ограничения попадает сетевая функциональность Canvas. Пользователь больше не сможет подтверждать выполнение сгенерированного кода для выхода в сеть. Возможность передавать документы для анализа в режиме блокировки.
Список ограничений нового режима выглядит так:
- запрет на просмотр веб-страниц в реальном времени;
- отключение функций Deep Research и Agent Mode;
- блокировка загрузки файлов для анализа;
- отказ от отображения изображений из сети;
- ограничение сетевой функциональности Canvas;
- невозможность одновременной работы с режимом разработчика.
Компания предупреждает, что новая функция подходит не всем пользователям. Для большинства людей отключение части привычных возможностей окажется слишком серьёзным ограничением, поэтому режим позиционируется как дополнительная мера для работы с особо чувствительными данными.
Активация режима блокировки автоматически отключает режим разработчика, поскольку задачи двух профилей во многом противоречат друг другу. Даже жёсткие ограничения не дают абсолютной гарантии безопасности. Определённый риск утечки информации сохраняется из-за работы подключённых приложений, неожиданных комбинаций возможностей системы или появления новых методов атак.
Механизм не способен полностью устранить все последствия атак с внедрением инструкций. Если вредоносная команда скрыта внутри загруженного документа, она всё ещё может повлиять на поведение модели и привести к формированию некорректного ответа, даже при заблокированной передаче данных наружу.
Одновременно с запуском режима блокировки OpenAI представила систему управления активными сеансами ChatGPT. Пользователи могут просматривать все открытые подключения к своему аккаунту и при необходимости завершать отдельные сессии или сразу выходить со всех устройств. В новом разделе отображается информация об используемом устройстве, приложении, примерном местоположении, времени входа, статусе доверенного устройства и отметка о том, является ли конкретная сессия текущей.



