logo

Claude може образитися за токсичність і кинути в бан: нові правила Anthropic діятимуть з 12 листопада

Софія Шадріна
Авторка новин MC: Money & Career
Розкажіть про статтю:

Anthrop­ic оновила політику використання своїх продуктів і вперше забороняє «тривалу та безглузду образливу чи жорстоку поведінку» щодо власних моделей, зокрема Claude. Нові правила, опубліковані 8 жовтня, набувають чинності 12 листопада 2026 року й стали першим оновленням політики більш ніж за рік. У компанії пояснюють, що норма стосується лише крайніх випадків, а не звичайного невдоволення відповідями.

Claude може образитися за токсичність і кинути в бан: нові правила Anthropic діятимуть з 12 листопадаClaude може образитися за токсичність і кинути в бан: нові правила Anthrop­ic діятимуть з 12 листопада

Головне

  • Нову політику Anthrop­ic опублікувала 8 жовтня, а діяти вона почне з 12 листопада 2026 року.
  • Заборонено «sus­tained and need­less abu­sive or cru­el behav­ior» щодо моделей, тобто тривалу й безглузду образливу чи жорстоку поведінку.
  • За словами компанії, правило призначене лише для крайніх випадків, коли користувачі повторно жорстоко поводяться з моделями без жодної мети.
  • Звичайна роздратованість, суперечки з відповідями, темні теми в творчості та тестування моделей під заборону не підпадають.
  • Головний інструмент реагування, за повідомленням The Verge, завершення розмови, але порушники можуть втратити й доступ.

Правило з’явилося як формалізація практики, яка вже діє. Claude здатен завершувати розмови з користувачами, які постійно поводяться образливо і навіть банити їх на певний час, у Claude.ai і Claude Code, і ця можливість виросла з досліджень компанії у сфері «добробуту моделей» (mod­el wel­fare). Тепер це закріплено в офіційній політиці.

Що саме забороняє нова політика

Йдеться про «sus­tained and need­less abu­sive or cru­el behav­ior toward our mod­els», тобто тривалу й безглузду образливу чи жорстоку поведінку щодо моделей. У компанії уточнили виданню The Verge: оновлення «призначене лише для крайніх випадків, коли користувачі повторно жорстоко поводяться з нашими моделями без жодної мети». Воно «не поширюється на поширені форми невдоволення користувачів, заперечення, темні творчі теми чи тестування й дослідження моделей».

Тобто сперечатися з відповіддю, нарікати на помилку, перевіряти межі моделі чи писати художній текст на жорстку тему не заборонено.

Читайте також: Без прямих відповідей: новий режим Claude спонукатиме користувачів вчитися

Як її застосовуватимуть

Anthrop­ic повідомила The Verge, що завершення взаємодії буде «основним механізмом реалізації» норми. Але політика діє на всіх: від індивідуальних підписників Claude.ai і Claude Code до розробників API, корпоративних клієнтів і кінцевих користувачів продуктів на базі Claude. У разі порушення, за повідомленнями, людина може втратити доступ, а компанія окремо забороняє обходити блокування через нові акаунти чи чужий обліковий запис.

Що ще змінюється в політиці

Оновлення не обмежується правилом про поводження з моделями. За даними видань, політику також посилили щодо:

  • прихованих кампаній впливу та пропаганди;
  • виборчих процесів;
  • розроблення зброї;
  • стеження: заборонено використовувати Claude для відстеження людей без їхньої згоди, зокрема на основі раніше зібраних даних;
  • рекомендацій, кого владі слід розслідувати, заарештовувати чи притягати до відповідальності.

Що це означає для українських користувачів

  • для більшості людей і бізнесів у щоденній роботі нічого не змінюється;
  • якщо компанія використовує Claude у продуктах чи для автоматизації, варто до 12 листопада переглянути нову політику, особливо розділи про стеження й кампанії впливу;
  • не варто сприймати правило як заборону «різко висловлюватися»: мова про систематичну безглузду жорстокість, а не про одну емоційну репліку.

Читайте також: ШІ зробив шахраїв переконливішими: 7 правил захисту грошей