Anthropic заявила, що Claude веде 26% її дослідницької роботи з ШІ

Anthropic заявила, що Claude веде 26% її дослідницької роботи з ШІ

Anthropic заявила, що Claude веде 26% її робіт із досліджень і розробок штучного інтелекту під наглядом людей.

Компанія Anthropic заявила, що її чатбот Claude «веде» 26% робіт із досліджень і розробок у сфері штучного інтелекту. Під цим у компанії розуміють здатність системи виконати більшу частину завдання від початку до кінця на основі високорівневої вказівки, тоді як людина здійснює нагляд.

Як повідомляє Engadget, Anthropic також стверджує, що ШІ виконує принаймні значні частини роботи під пильним керівництвом людей у понад 90% її досліджень. До цього показника входять і 26% завдань, які, за визначенням компанії, веде Claude.

Водночас Anthropic зазначила, що Claude не працює повністю автономно в жодній вимірюваній частині її дослідницьких і розробницьких процесів.

 

Три запропоновані показники

 

Ці дані Anthropic оприлюднила разом із пропозицією трьох способів оцінювати темпи розвитку ШІ. Перший показник — «дослідження та розробки ШІ, керовані ШІ» — має відстежувати, яку частину робіт виконує Claude. Для цього компанія поєднала власний індекс частки роботи, виконаної системою, зі шкалою автоматизації, розробленою Epoch AI.

На основі цих даних Anthropic створила графік рівня автоматизації Claude від серпня 2025 року. Компанія вважає, що інші розробники передових моделей можуть відтворити такий підхід на власних даних за умови перевірки третьою стороною.

 

Нагляд за агентами і обчислювальні ресурси

 

Ще два запропоновані показники стосуються нагляду за ШІ-агентами та обсягу обчислювальних ресурсів, спрямованих на дослідження й розробки ШІ. Для агентів Anthropic пропонує вимірювати, яка частина їхньої діяльності контролюється, скільки часу займає її перевірка та як часто поведінку систем позначають як проблемну.

Компанія вважає, що прозоріші вимірювання дадуть змогу чіткіше оцінювати темпи розробки передових систем і реагувати на потенційно неконтрольований розвиток технології. Anthropic також зобов’язалася допускати незалежних оцінювачів до перевірки своїх практик розробки.