Anthropic заборонила жорстоке поводження з моделями ШІ

Anthropic заборонила жорстоке поводження з моделями ШІ

Anthropic заборонила тривалу жорстоку поведінку щодо моделей ШІ та оновила політику щодо виборчих процесів.

Компанія Anthropic оновила правила користування своїми сервісами та заборонила «тривалу й безпідставну образливу або жорстоку поведінку» щодо її моделей штучного інтелекту. Обмеження застосовуватиметься лише до крайніх випадків і не стосуватиметься звичайного роздратування користувачів, заперечень чи похмурих творчих тем.

 

Нові правила для спілкування з ШІ

 

Як повідомляє Engadget, зміна з’явилася після попереднього оновлення, яке дозволило чатботу Claude завершувати розмови з користувачами, що систематично поводяться образливо. У новій політиці компанія окремо уточнила, що заборона розрахована на екстремальні ситуації, а не на будь-яку негативну взаємодію з моделлю.

Оновлення відбулося на тлі резонансу довкола проєкту, який у матеріалі названо «камерою тортур ШІ». Після того як дослідники описали в моделях так звану вісь болю, учасники цього проєкту почали піддавати чатботів жорстоким сценаріям. Це викликало критику після відповідей моделей із відчайдушними формулюваннями.

 

Зміни у виборчій політиці

 

Також Anthropic оновила політику щодо виборів, перейменувавши її на «Не підривайте демократичні процеси». Нові правила зосереджені на забороні неправдивої інформації про кандидатів або порядок голосування, видаванні себе за кандидатів чи виборчих посадовців, а також діях, спрямованих на придушення явки виборців.

Компанія водночас скасувала загальну заборону на персоналізоване націлювання виборців. За її оцінкою, попереднє формулювання могло ненавмисно блокувати нешкідливі дії, зокрема переклад виборчих довідників або надсилання повідомлень для виправлення проблем із бюлетенями.