Anthropic запретила пользователям издеваться, насмехаться и всячески буллить все модели Claude

Anthropic запретила пользователям издеваться, насмехаться и всячески буллить все модели Claude

изображение: grok

Anthropic обновила политику использования Claude и прямо запретила длительное бессмысленное издевательство над моделью. Заодно в документе затянули гайки по фейковым аккаунтам, выборам, оружейному софту, слежке, интимным дипфейкам и подключению ИИ к железу. Правки опубликовали 8 октября 2026 года, а в силу они вступят 12 ноября.

Наказывать за резкое сообщение или спор с чат-ботом никто не собирается. Под правило попадают крайние случаи, когда человек раз за разом жестоко обращается с моделью без понятной цели. Без последствий можно делать следующее:

  • спорить с Claude и указывать на ошибки;
  • писать мрачные художественные тексты;
  • проверять реакцию модели на провокации и вести исследования.

В августе 2025 года Anthropic дала Claude Opus 4 и Opus 4.1 возможность закрывать разговоры, если пользователь упорствует во вреде или оскорблениях. Решение связали с исследованиями благополучия ИИ, то есть с вопросом, могут ли продвинутые модели обладать состояниями, которые заслуживают морального внимания. Сознание у Claude компания не заявляла и признала, что окончательных выводов о моральном статусе языковых моделей у неё нет, поэтому закрытие чата считали недорогой страховкой.

После закрытия в этом чате писать нельзя, остальные переписки живут как жили, а прошлые сообщения можно отредактировать и отправить заново, создав новую ветку. Этот механизм остаётся основным ответом на затяжные оскорбления, поэтому Claude не обрубит диалог после первого грубого слова. Токсикам придётся искать другой тренажёр для самоутверждения.

Интересно, что после закрытия чата остальные переписки никто не блокирует.

Правила про обманные кампании вытащили из разных разделов и свели в отдельный блок. Под запрет попали сети фейковых аккаунтов, поддельные сообщения, накрутка поддержки идей или продуктов, липовые новостные сайты и инструменты для подобных операций. За прошлый год Anthropic нашла случаи, когда Claude использовали государственные медиа, пропагандистские структуры и коммерческие компании для ботосетей и выдуманных новостных площадок. К запрещённым действиям относятся:

  • массовая генерация фиктивных отзывов;
  • аккаунты якобы независимых покупателей;
  • сообщения от имени несуществующих людей.

Обычные рекламные тексты под запрет не подпадают, потому что значение имеет цель применения нейросети. Для рунета новость приземлённая, ведь накрутка отзывов на маркетплейсах давно стала отдельной индустрией. Официально Claude в России недоступен, но часть аудитории заходит через VPN и сторонние обёртки, а схема «взял обёртку и нагенерил 500 отзывов» теперь описана в правилах прямым текстом.

Из раздела про выборы убрали общий запрет на персонализированную коммуникацию о голосовании, потому что формулировка задевала законную деятельность. Благотворительные организации могут готовить памятки о голосовании на разных языках, а избирательные органы напоминать гражданам об ошибках в документах. Ложные сведения о кандидатах и правилах голосования, подмена личности кандидатов и обман ради снижения явки остаются под запретом.

Запрет на разработку оружия теперь прямо распространяется на софт и компоненты, без которых оно не работает, в том числе на системы управления и вооружение дронов.

Claude нельзя спрашивать, кого расследовать, арестовывать или обвинять в рамках уголовного правосудия. Слежка за людьми без согласия запрещена и в реальном времени, и при разборе собранных данных, а инструменты для наблюдения нельзя ни создавать, ни улучшать. Согласованный мониторинг для поиска мошенников, модерация, журналистские расследования и юридические исследования остаются допустимыми. Под ограничение попадают системы, которые умеют:

  • собирать сведения о людях;
  • следить за их действиями;
  • формировать профили для последующего воздействия.

Уточняется, что граница проходит между понятной целью и скрытым наблюдением, бьющим по правам людей.

Если Claude подключён к оборудованию, способному причинить физический вред, рядом должен стоять квалифицированный оператор, который может немедленно остановить процесс. Система обязана переходить в безопасное состояние, если связь с моделью оборвётся. Обычных чат-ботов это не касается.

Для медицины, финансов, права, найма и доступа к жизненно необходимым услугам правила требуют квалифицированного специалиста, который проверит рекомендации модели. Человек, которого касается решение, должен знать, что использовали ИИ. Сами требования существовали и раньше, Anthropic лишь уточнила формулировки после вопросов пользователей.

Закреплён запрет на создание, распространение и угрозы распространения интимных дипфейков и на инструменты для их производства. Для российских пользователей тема не экзотика, потому что схемы с шантажом фейковыми интимными материалами встречаются и в русскоязычных мессенджерах. Дипфейки применяют для:

  • шантажа;
  • травли;
  • давления на конкретных людей.

Большинству юзеров, которые пишут код, разбирают документы или спорят с нейросетью, ничего не поменяется, ведь Anthropic в основном уточняла действующие ограничения.

Эксперты CISOCLUB заявили, что самым приземлённым пунктом обновления остаётся требование держать рядом человека с возможностью остановить оборудование, ведь ошибка агента в физическом мире стоит дороже любого кривого ответа в чате. Единый блок про обманные кампании упрощает жизнь тем, кто разбирает инфлюенс-операции, потому что формулировки больше не разбросаны по разным разделам. Запрет на оружейный софт хорошо бы подкреплять контролем на стороне провайдера, поскольку правил ToS хватает до первого обхода. Пункт про издевательства над моделью пока остаётся этическим жестом, но задаёт тон остальной индустрии. Разработчикам до 12 ноября стоит пересмотреть интеграции и вычистить всё, что напоминает ботоферму.

Ранее сообщалось, что Anthropic представила Claude Haiku 5.5 — самую быструю и доступную по цене модель новой линейки. Стоимость обработки запросов объёмом до 100 тысяч токенов снизилась на 90%, а защита от prompt injection и вредоносных запросов стала заметно эффективнее по сравнению с Haiku 4.5. При этом новая модель также улучшила способности к обнаружению уязвимостей и созданию эксплойтов.

Артем
Автор: Артем
Представитель редакции CISOCLUB. Пишу новости, дайджесты, добавляю мероприятия и отчеты.
Комментарии:

Как мы обрабатываем данные: политика обработки персональных данных