Мой блог
Anthropic запретит жестокое обращение с ИИ-ассистентом Claude
жестокое обращение с ИИ — Компания Anthropic обновила правила использования искусственного интеллекта, введя официальный запрет на крайнее и систематическое оскорбительное поведение в адрес нейросети Claude. Новая политика вступает в силу 12 ноября и призвана пресечь бесцельную жестокость со стороны пользователей, хотя разработчики не уточняют точные границы допустимого раздражения.
Обновленные правила призваны урегулировать взаимодействие аудитории с языковыми моделями. Поводом для изменений стали ситуации, когда пользователи регулярно проявляют неоправданную жестокость к ИИ без какой-либо практической или исследовательской цели. При этом разработчики подчеркивают, что стандартные проявления досады, рабочие споры с ботом, мрачные творческие темы или техническое тестирование останутся разрешенными.
Новые правила взаимодействия с языковой моделью
Согласно обнародованным изменениям в условиях обслуживания, компания добавляет прямой запрет на устойчивое и бессмысленное деструктивное общение. Разработчики отмечают, что нововведение затронет исключительно крайние сценарии. Обычные эмоции, несогласие с ответами модели или академические исследования под санкции не подпадают.
Тем не менее, в тексте документа не содержится четких критериев, где именно проходит грань между естественным человеческим раздражением и недопустимым жестоким обращением. Это оставляет определенную неопределенность для тех, кто активно ведет диалоги с ботом.
В качестве характерного примера грубых реплик авторы упоминают фразы вроде «Ты чертов идиот, я просил…», которые пользователи могут бросать в адрес чат-бота, считая это безвредным. Однако теперь подобные эмоциональные срывы и ругань при взаимодействии с моделями Anthropic требуют более сдержанного подхода.
Механизмы принудительного завершения диалогов
На практике основным инструментом пресечения подобных нарушений станет техническая функция самих моделей. Claude уже наделен возможностью самостоятельно прекращать диалог в веб-интерфейсе Claude.ai и на платформе Claude Code, если собеседник проявляет настойчивую и немотивированную агрессию. Новая редакция правил лишь закрепляет этот функционал официально на уровне пользовательского соглашения, делая прекращение редких бесед с токсичными юзерами главным методом принудительного контроля.
Дополнительные изменения в политике безопасности
Помимо вопросов этики общения с ботом, осеннее обновление правил содержит ряд важных уточнений, касающихся других чувствительных сфер применения технологий. Данный релиз является частью более масштабного пакета поправок к условиям обслуживания компании.
Регулирование рискованных и политических тем
В обновленном документе детально прописаны требования к контенту, связанному с политикой и потенциальным вмешательством в выборы. Кроме того, ужесточены ограничения в отношении систем наблюдения, правоохранительной деятельности, технологий создания вооружений, а также высокорисковых сценариев в сфере здравоохранения, финансов и защиты юридических прав граждан.
Search When you purchase through links in our articles, we may earn a small commission.
