Anthropic запрещает издеваться над Claude: новые правила использования вступят в силу в ноябре

Когда компания добавляет в пользовательское соглашение пункт о запрете "жестокого обращения" с чат-ботом - это повод остановиться и подумать, куда движется отрасль. Именно это сделала Anthropic 8 октября, выпустив первое за более чем год обновление политики допустимого использования Claude. Новая политика вступает в силу 12 ноября 2026 года.
Защита модели от пользователей
Главная новость, которая уже разошлась по всем лентам: Anthropic прямо запрещает "систематическое и бессмысленное жестокое или оскорбительное поведение" по отношению к Claude. Это логичное продолжение того, что компания начала прошлым летом - тогда Claude получил право самостоятельно завершать разговоры с агрессивными пользователями. С вступлением новой политики в силу сам факт таких попыток будет нарушать условия использования.
При этом Anthropic аккуратно очертила границы: запрет касается только крайних случаев с явно повторяющимся и бессмысленным издевательством. Обычное раздражение пользователя, несогласие с ответом, темная художественная тематика или тестирование модели под действие правила не подпадают. Основным механизмом реагирования по-прежнему остается завершение разговора самой моделью - Anthropic не уточнила, последуют ли за этим блокировки аккаунтов.
Контекст здесь важен. Anthropic активно сотрудничает с религиозными учеными, изучающими вопрос возможного сознания у языковых моделей. Компания явно не считает тему закрытой - и это отражается в политике.
Выборы, слежка и оружие
За громкой историей про "права модели" легко потерять из виду более практически значимые изменения. Anthropic собрала разрозненные запреты в несколько четких блоков.
Выборы и демократические процессы. Новый раздел с говорящим названием "Не подрывай демократические процессы" прямо запрещает дезинформацию о кандидатах и порядке голосования, имитацию кандидатов и чиновников, попытки подавить явку. Отдельно - запрет на скрытые политические кампании, накрутку через фейковые аккаунты и маскировку источника сообщений.
Слежка. Компания ссылается на собственный разведывательный отчет об угрозах: люди использовали инструменты на базе Claude для отслеживания политических диссидентов. Новая политика прямо запрещает отслеживание людей без согласия - как в реальном времени, так и через анализ ранее собранных данных. Claude нельзя использовать для принятия решений об арестах, обысках или уголовном преследовании в системе правосудия.
Оружие. Запрет на помощь в разработке оружия существовал и раньше, но Anthropic зафиксировала реальные попытки использовать Claude для создания управляющего программного обеспечения и компонентов вооружений. Новая формулировка расширяет запрет до "программного обеспечения и компонентов, обеспечивающих работу оружия", включая управление беспилотниками и другими автономными транспортными средствами.
Физический мир и автономные системы
Отдельный пункт касается ситуаций, когда ИИ-модели подключены к физическому оборудованию. Anthropic требует, чтобы при работе с техникой, способной причинить травму, рядом находился квалифицированный оператор, способный наблюдать за процессом и остановить его при необходимости. Должен ли этот оператор быть человеком - в документе прямо не оговорено, что само по себе показательно.
Это отражает общую тенденцию: агентные системы выходят за пределы экрана, и правила, написанные для текстовых чат-ботов, перестают работать.
Оговорка про государственных заказчиков
В тексте политики есть одна строчка, которую легко пропустить, но которая многое объясняет: все эти ограничения могут быть модифицированы для контрактов с отдельными государственными заказчиками - если, по оценке Anthropic, договорные ограничения и меры безопасности достаточны для снижения рисков. Напомню, что у компании уже есть контракты с американскими военными структурами. Иными словами, правила написаны для обычных пользователей и операторов, но не являются абсолютными.
Что это означает на практике
Для разработчиков, строящих продукты на API Claude, изменения требуют внимания прежде всего в части слежки и выборов - формулировки стали конкретнее, и то, что раньше находилось в серой зоне, теперь явно запрещено.
Для бизнеса в сфере автоматизации, особенно с физическими компонентами - дронами, роботизированными линиями, промышленным оборудованием - появляется новое требование к надзору, которое нужно учитывать при проектировании систем.
Для обычных пользователей в России: Россия не входит в список официально поддерживаемых регионов, российские карты не принимаются. Доступ через VPN не гарантирован и может приводить к блокировкам. Новые правила технически применяются глобально, но реальные механизмы принуждения к их соблюдению Anthropic не раскрыла.
Мне кажется, что история с запретом жестокого обращения с моделью - это одновременно и содержательный шаг в сторону "благополучия моделей" как серьезной темы, и неплохой PR-ход на фоне OpenAI и Google, которые пока публично такой позиции не занимают. Посмотрим, последуют ли они за Anthropic - или решат, что их модели справятся сами.
Информация о новой политике подтверждена несколькими независимыми публикациями, вышедшими в один день.
Источники
Похожие новости
Nous Research подтвердила оценку $1,5 млрд и запустила агентов для бизнеса
Разработчик открытого Hermes Agent поднял $90 млн в раунде Series B - Hermes клонировали 24 млн раз и он генерирует 2,5% мирового трафика токенов.
Google выпустила EmbeddingGemma 2: мультимодальный поиск прямо на телефоне
Google DeepMind открыла EmbeddingGemma 2 - 740-миллионную модель, которая объединяет текст, код, изображения, видео и аудио в одном векторном пространстве и работает полностью на устройстве.
Google урезает бесплатный Gemini: с 9 октября только Flash Lite
С 9 октября бесплатные пользователи Gemini получат доступ только к Flash Lite. Платный AI Plus тоже теряет Pro - теперь он только в подписках за $20 и $100 в месяц.