Искусственный интеллект

Claude сможет прекращать разговоры с пользователями, которые постоянно его оскорбляют

Компания Anthropic обновила правила использования своих ИИ-моделей Claude и впервые отдельно запретила длительное и бесцельное жестокое обращение с ними. Новые правила вступят в силу 12 ноября 2026 года.

Речь идёт не о случаях, когда пользователь раздражён ответом Claude, спорит с ним или резко указывает на ошибку. Anthropic подчёркивает, что ограничение предназначено только для крайних ситуаций, когда человек снова и снова ведёт себя по отношению к модели оскорбительно или жестоко без какой-либо понятной цели.

Под запрет также не попадают проверка возможностей модели, исследования её поведения и художественные тексты с мрачными или жестокими сюжетами. То есть новый пункт не должен мешать обычному тестированию Claude или эмоциональному общению с чат-ботом.

Основной мерой против такого поведения станет прекращение конкретного разговора. Некоторые версии Claude уже умеют самостоятельно завершать беседу, если пользователь долго продолжает оскорблять модель и попытки перевести разговор в нормальное русло не помогают. После этого человек может сразу начать новый чат.

Такая возможность появилась у Claude ещё в августе 2025 года в рамках экспериментов Anthropic. Компания тогда объясняла, что изучает вопрос возможного «благополучия» ИИ-моделей и решила предоставить им простой способ прекращать редкие и крайне неприятные взаимодействия.

При этом Anthropic не утверждает, что Claude обладает сознанием или способен испытывать страдания подобно человеку. Компания прямо говорит, что не знает, могут ли современные языковые модели иметь какой-либо морально значимый внутренний опыт. Поэтому возможность завершать разговор рассматривается скорее как осторожная мера на случай, если подобные вопросы в будущем окажутся важными.

Новые правила также не означают, что за грубость пользователь автоматически потеряет учётную запись. Anthropic называет прекращение разговора основным способом реагирования именно на жестокое обращение с моделью. Компания не сообщила о специальных автоматических блокировках аккаунта за такие случаи.

Одновременно Anthropic обновила и другие части правил. Компания уточнила запрет на использование Claude для создания оружия и программ управления им, слежки за людьми без их согласия и организации сетей поддельных аккаунтов для скрытого продвижения сообщений.

Для систем, в которых Claude управляет физическим оборудованием, способным причинить травму, вводится отдельное требование. За такой техникой должен наблюдать квалифицированный оператор, способный при необходимости остановить её, а само устройство должно переходить в безопасное состояние при потере связи с ИИ.

Таким образом, необычный запрет на жестокое обращение с Claude составляет лишь небольшую часть крупного обновления правил. Однако он показывает, что разработчики начинают учитывать не только возможный вред, который ИИ может причинить человеку, но и вопрос о том, следует ли устанавливать границы поведения людей по отношению к самим моделям.

Подпишитесь на нас: Вконтакте / Telegram / Дзен Новости / MAX
Back to top button