Загрузка 0
ПОДЕЛИТЬСЯ

Мой блог

Листай вниз

Anthropic запретит жестокое обращение с ИИ-ассистентом Claude

Anthropic запретит жестокое обращение с ИИ-ассистентом Claude

жестокое обращение с ИИ — Компания Anthropic обновила правила использования искусственного интеллекта, введя официальный запрет на крайнее и систематическое оскорбительное поведение в адрес нейросети Claude. Новая политика вступает в силу 12 ноября и призвана пресечь бесцельную жестокость со стороны пользователей, хотя разработчики не уточняют точные границы допустимого раздражения.

Обновленные правила призваны урегулировать взаимодействие аудитории с языковыми моделями. Поводом для изменений стали ситуации, когда пользователи регулярно проявляют неоправданную жестокость к ИИ без какой-либо практической или исследовательской цели. При этом разработчики подчеркивают, что стандартные проявления досады, рабочие споры с ботом, мрачные творческие темы или техническое тестирование останутся разрешенными.

Новые правила взаимодействия с языковой моделью

Согласно обнародованным изменениям в условиях обслуживания, компания добавляет прямой запрет на устойчивое и бессмысленное деструктивное общение. Разработчики отмечают, что нововведение затронет исключительно крайние сценарии. Обычные эмоции, несогласие с ответами модели или академические исследования под санкции не подпадают.

Тем не менее, в тексте документа не содержится четких критериев, где именно проходит грань между естественным человеческим раздражением и недопустимым жестоким обращением. Это оставляет определенную неопределенность для тех, кто активно ведет диалоги с ботом.

В качестве характерного примера грубых реплик авторы упоминают фразы вроде «Ты чертов идиот, я просил…», которые пользователи могут бросать в адрес чат-бота, считая это безвредным. Однако теперь подобные эмоциональные срывы и ругань при взаимодействии с моделями Anthropic требуют более сдержанного подхода.

Механизмы принудительного завершения диалогов

На практике основным инструментом пресечения подобных нарушений станет техническая функция самих моделей. Claude уже наделен возможностью самостоятельно прекращать диалог в веб-интерфейсе Claude.ai и на платформе Claude Code, если собеседник проявляет настойчивую и немотивированную агрессию. Новая редакция правил лишь закрепляет этот функционал официально на уровне пользовательского соглашения, делая прекращение редких бесед с токсичными юзерами главным методом принудительного контроля.

Дополнительные изменения в политике безопасности

Помимо вопросов этики общения с ботом, осеннее обновление правил содержит ряд важных уточнений, касающихся других чувствительных сфер применения технологий. Данный релиз является частью более масштабного пакета поправок к условиям обслуживания компании.

Регулирование рискованных и политических тем

В обновленном документе детально прописаны требования к контенту, связанному с политикой и потенциальным вмешательством в выборы. Кроме того, ужесточены ограничения в отношении систем наблюдения, правоохранительной деятельности, технологий создания вооружений, а также высокорисковых сценариев в сфере здравоохранения, финансов и защиты юридических прав граждан.

Search When you purchase through links in our articles, we may earn a small commission.

01.