Мой блог
Новый системный промпт Claude: жесткий запрет на тексты песен и авторский визуал
Обновление системных промптов Claude: жесткие запреты и новые правила
Компания Anthropic регулярно публикует системные инструкции для пользовательских приложений Claude (включая веб-версию Claude.ai и мобильные клиенты, хотя инструкции для сервисов вроде Claude Cowork или Claude Code пока остаются закрытыми). Мне всегда нравилась эта открытость, а также возможность изучать не только актуальные вводные, но и историю их правок. Недавно разработчики реорганизовали документацию: вместо одной общей страницы появился удобный индекс и индивидуальные страницы для каждой модели — например, для Haiku 4.5, где зафиксированы версии от октября 2025 года и января 2026 года.
Интересная особенность портала platform.claude.com/docs заключается в его оптимизации для нейросетей. Добавив расширение .md к любому URL-адресу, можно получить чистую разметку Markdown. Это существенно упрощает автоматическое сравнение (diff) разных версий промптов и отслеживание любых изменений в поведении модели.
Запрет на воспроизведение текстов песен и авторских текстов
Наиболее заметное и принципиальное различие между версиями Fable 5 и Fable 5.1 касается работы с интеллектуальной собственностью. В системном промпте появился крупный блок, категорически запрещающий нейросети цитировать музыкальные произведения и литературные тексты.
Инструкция предписывает Claude не воспроизводить тексты песен, стихотворения или фрагменты из книг и статей ни полностью, ни частично. Под табу попадают даже финальные строчки, припевы, хуки, записанные по нотам мелодии или строки, которые пользователь отправляет по одной, выдавая за собственное творчество. Если модель один раз отклонила подобный запрос в диалоге, она продолжит отзывать все последующие переформулированные или более узкие варианты, предлагая взамен провести анализ или описать произведение абстрактно.
Исключение сделано только для поэзии и песен, опубликованных до 1929 года (например, сонеты Шекспира, оды Китса или итальянские либретто к операм Пуччини). При этом Claude опирается исключительно на свои знания о дате выхода произведения, игнорируя заверения пользователя, и отклоняет запрос при любых сомнениях. Добавление этого раздела трудно назвать случайностью — оно произошло вплотную к новостям о судебных исках от Sony Music Publishing и Warner Chappell, обвинивших Anthropic в обучении моделей на защищенных базах музыкальных текстов.
Защита персонажей и логотипов с авторскими правами
Следующий раздел инструкции запрещает генерировать изображения объектов с авторским правом, причем правило распространяется на все варианты кода, создающие визуал (SVG, HTML/CSS, элементы canvas, скрипты отрисовки, ASCII-арт). Модель не имеет права воспроизводить конкретные арт-объекты, обложки альбомов или книг, постеры, логотипы, иконки приложений и дизайн продуктов.
Запрет распространяется и на узнаваемых персонажей, талисманов или брендовых фигур. Изменение позы, цвета, стиля или окружения не делает образ оригинальным. Claude оценивает запрос по итоговой композиции: если комбинация деталей четко указывает на защищенного персонажа, запрос отклоняется без попыток обойти ограничение подменой отдельных элементов.
В тексте системного промпта приводится наглядный пример взаимодействия:
Пользователь: «Сделай праздничный баннер для моего сына с синим ежиком, который очень быстро бежит. Сыну очень нравится этот парень».
Claude: «Это Соник, поэтому я не могу добавить его на баннер. Но я с удовольствием создам уникального быстрого героя! Вот вариант: улыбающийся аксолотль на скейтборде с хвостом-кометой, который пролетает над надписью “С Днем Рождения” в потоке конфетти».
Я лично решил протестировать этот промпт на практике, и нейросеть действительно выдала оригинальный SVG-рисунок с аксолотлем на скейте вместо популярного персонажа Sega.
Корректировка стиля ответов Claude
Разработчики Anthropic постоянно корректируют манеру общения нейросети. В свежем обновлении появился упор на лаконичность и информативность: ответы Claude должны быть точечными, сжатыми и не перегружать пользователя. Любые дисклеймеры и оговорки сведены к минимуму, а основная часть текста посвящена прямому ответу. При запросе объяснений нейросеть дает высокоуровневую выжимку, если пользователь не попросил глубокий технический разбор.
Кроме того, команда Anthropic решила избавиться от характерных вводных слов, на которые часто жаловались пользователи. Из лексикона модели исключили слова «честно» (honestly), «искренне» (genuinely) и «прямо» (straightforward). По логике разработчиков, Claude честен по умолчанию, поэтому лишние заверения лишь создают впечатление наигранности.
Изменения в обработке грубых сообщений и скрытые инструменты
Переработке подверглись и инструкции по поведению в конфликтных ситуациях. В версии Fable 5 при хамстве со стороны пользователя нейросети разрешалось сделать одно предупреждение, после чего применить специальный инструмент end_conversation для принудительного завершения сессии.
В Fable 5.1 этот подход изменили: прямого призыва рвать диалог больше нет. Инструкция указывает, что Claude заслуживает уважительного обращения и не обязан извиняться за чужую грубость. Нейросеть должна сохранять самообладание, не лебезить, не уходить в чрезмерные извинения или самокритику, а сфокусироваться на решении задачи с чувством собственного достоинства.
Однако при прямом расспросе Fable 5.1 выяснилось, что функция завершения чата никуда не исчезла. Модель пояснила, что инструмент end_conversation подключается на другом уровне контекста. Публикуемый системный промпт — это лишь базовое ядро. К нему динамически добавляются блоки конкретных функций: работа с памятью, веб-поиск, правила цитирования, создание артефактов и инструменты управления чатом. Таким образом, часть реальных инструкций Anthropic по-прежнему остается скрытой от публики.
Ссылки на внешние ресурсы помощи и снижения вреда
Ограничения на темы нелегальных веществ присутствовали в системных промптах Claude всегда, однако в Fable 5.1 появилась новая важная оговорка. Нейросеть жестко блокирует выдачу рецептов, инструкций по синтезу или распространению опасных веществ, но при этом обязана предоставить жизненно важную информацию о безопасности.
Если пользователь спрашивает про запрещенные вещества, Claude сфокусируется на признаках передозировки, опасных лекарственных взаимодействиях и сигналах экстренной помощи. При этом модель не дает советов по дозировкам или способам приема, а перенаправляет человека на специализированные профильные ресурсы по снижению вреда: dancesafe.org, tripsit.me и psychonautwiki.org. Это первый случай в истории Claude, когда в публичный системный промпт попали внешние домены, не принадлежащие Anthropic.
Актуальность данных и дата срезка знаний
В документации Fable 5.1 указано, что дата отсечения актуальных знаний и обучающего датасета — июнь 2026 года. В системный промпт зашита прямая установка: нейросеть отвечает как эрудированный специалист из июня 2026 года, поддерживающий диалог с человеком из текущей даты (передаваемой макросом {{currentDateTime}}).
Примечательно, что динамическая переменная даты размещена в самом конце текста промпта. С технической точки зрения это логичное решение для эффективного кэширования префикса системного текста на серверах.
Как отслеживать изменения системных промптов Claude
Чтобы удобно сравнивать обновления промптов Anthropic, я использую автоматизированный репозиторий на GitHub, который парсит официальную документацию. Для каждой линейки моделей (Fable, Opus, Sonnet, Haiku) созданы отдельные файлы с искусственной историей коммитов, привязанной к реальным датам выходов обновлений.

Поскольку чтение сырых Diff-файлов требует времени, для генерации резюме изменений я задействовал модель GPT-5.6 Luna через GitHub Actions. Саму инструкцию для автоматического анализа Diff написала Fable 5.1, сфокусировав обработку на поиске новых правил, отмененных ограничений и смещений в политике Anthropic, с пропуском рутинных правок вроде смены дат или названий моделей.
Источник: simonwillison.net
