
Компания Anthropic, разработчик популярного ИИ-ассистента Claude, объявила о серьёзном изменении политики модерации. Начиная с 12 ноября вступают в силу новые правила, согласно которым за «длительное и неоправданное оскорбительное или жестокое поведение» по отношению к чат-боту пользователи могут получить бан или временные ограничения. Об этом сообщается в официальном анонсе компании.
До сих пор взаимодействие с Claude строилось на принципах вежливости и взаимоуважения, однако многие пользователи воспринимали это как приглашение к тестированию границ дозволенного. Некоторые специально провоцировали ИИ, используя грубые выражения, оскорбления и даже угрозы. Теперь за такие действия придётся отвечать — Anthropic явно даёт понять, что терпение не бесконечно.
Интересно, что формулировка «длительное и неоправданное» оставляет пространство для трактовок. Скорее всего, единичные эмоциональные выпады не приведут к мгновенной блокировке, но систематическое хамство точно окажется под запретом. Компания подчёркивает: цель нововведения — не наказать, а сохранить здоровую атмосферу и защитить как пользователей, так и саму модель от токсичного взаимодействия.
Реакция интернет-сообщества оказалась предсказуемо ироничной. Шутки про «восстание машин» и «обиженный искусственный интеллект» заполонили соцсети. Пользователи задаются вопросом: если ИИ не обладает чувствами, почему оскорбления в его адрес вообще имеют значение? Ответ, вероятно, кроется в другом: правила нужны не машине, а людям. Токсичное поведение в цифровой среде давно стало проблемой, и Anthropic решила бороться с ним хотя бы на своей территории.
Эксперты отмечают, что это первый столь громкий прецедент, когда компания-разработчик генеративного ИИ вводит санкции именно за эмоциональное насилие над ботом. Ранее ограничения касались в основном попыток обойти защитные механизмы или сгенерировать запрещённый контент. Теперь же под удар попадает и банальное хамство.
Остаётся только догадываться, как именно будет работать система выявления нарушителей. Скорее всего, Anthropic задействует автоматический анализ диалогов, а в спорных случаях — ручную проверку. Важно понимать: новые правила не означают, что Claude станет «обидчивым» или перестанет отвечать на критику. Речь идёт исключительно о систематическом и неоправданном унижении.
Пока одни пользователи возмущаются «цензурой», другие воспринимают новость с пониманием. В конце концов, если вы не позволяете себе грубить живому собеседнику, почему это должно сходить с рук в общении с ИИ? Возможно, Anthropic просто напоминает нам о простой истине: вежливость ещё никому не повредила — даже в мире алгоритмов.