Anthropic заборонила жорстоке поводження з чатботом Claude

Anthropic заборонила жорстоке поводження з чатботом Claude

Anthropic оновила правила Claude, заборонивши жорстоке поводження з моделлю та посиливши обмеження щодо пропаганди, стеження і зброї.

Компанія Anthropic оновила правила використання свого чатбота Claude та заборонила «тривалу і безпідставну образливу або жорстоку поведінку» щодо моделі. Зміни також стосуються застосування штучного інтелекту для втручання у вибори, розробки зброї, стеження, а також окремих сценаріїв у сферах охорони здоров’я та фінансів.

Як повідомляє The Verge, нове правило про поводження з Claude має застосовуватися лише в крайніх випадках, коли користувач неодноразово поводиться жорстоко з моделлю без очевидної мети. У компанії наголосили, що обмеження не поширюється на звичайне роздратування користувачів, заперечення, темні творчі теми, тестування моделей чи дослідження.

Припинення розмов як санкція

 

Основним механізмом виконання цієї вимоги Anthropic назвала припинення діалогів. У серпні компанія вже повідомляла, що дозволить Claude завершувати спілкування з користувачами, які демонструють постійно шкідливу або образливу поведінку. Це було частиною досліджень компанії у сфері добробуту моделей.

У лютому керівник досліджень добробуту моделей Anthropic Кайл Фіш заявляв, що питання можливого внутрішнього досвіду, свідомості, морального статусу та добробуту моделей компанія розглядає серйозно. Того ж місяця генеральний директор Anthropic Даріо Амодеї сказав, що компанія не знає, чи є моделі свідомими.

Обмеження для пропаганди, стеження і зброї

 

Оновлена політика окремо забороняє оманливі комерційні та політичні кампанії. Зокрема, не можна приховувати, хто стоїть за повідомленням, або штучно посилювати контент через фальшиві облікові записи чи публікації. Розділ про вибори забороняє дезінформацію про кандидатів чи процедуру голосування, видавання себе за кандидатів або виборчих посадовців та спроби придушити явку виборців.

Anthropic також розширила заборону на використання Claude для розробки озброєнь. Вона охоплює програмне забезпечення й компоненти, необхідні для роботи зброї, а також дії на кшталт озброєння дронів та інших автономних транспортних засобів. Компанія заявила, що фіксувала спроби отримати за допомогою Claude інструкції для створення такого ПЗ і керування ним.

Політика чіткіше обмежує стеження: відстежувати людей без їхньої згоди не дозволяється як у реальному часі, так і через аналіз раніше зібраних даних. Claude також не можна використовувати для ухвалення чи надання рекомендацій щодо того, кого розслідувати, заарештовувати або обвинувачувати у правоохоронних і кримінальних процесах. Для моделей, підключених до обладнання, здатного автономно виконувати фізичні дії та завдавати травм, має бути передбачена можливість кваліфікованому оператору спостерігати за роботою обладнання і за потреби зупинити його.