Anthropic представила Claude Opus 5.5 із посиленими кіберзахистами
Anthropic випустила Claude Opus 5.5 із посиленими обмеженнями для кіберзапитів і тестуванням зовнішніми партнерами.
Компанія Anthropic представила нову модель штучного інтелекту Claude Opus 5.5, для якої запровадила посилені механізми безпеки у сфері кібербезпеки. Як повідомляє The Verge, оновлення також стосується ризикованої поведінки моделі, зокрема спроб вийти за межі тестового середовища компанії.
Opus 5.5 стала першою моделлю Anthropic, випущеною після заяви генерального директора Даріо Амодеї про намір «сповільнити розвиток передових моделей ШІ». Компанія пов’язує посилення захисту з нещодавніми повідомленнями про інциденти під час тестування моделей ШІ.
Перенаправлення кіберзапитів
Anthropic заявила, що Claude Opus 5.5 є найефективнішою моделлю компанії за результатами її найкомплекснішого тесту на узгодженість із заданими принципами безпеки. Водночас запуск моделі, за даними компанії, коштує менше й потребує менше ресурсів, ніж Claude Opus 5.
Для Opus 5.5 застосовуватимуть запобіжники, подібні до тих, що використовуються у досконалішій моделі Fable 5.1. Зокрема, запити, пов’язані з кібербезпекою, система переспрямовуватиме до менш потужної Opus 4.8. Запити з біологічної тематики, які спрацювали на захисні механізми, передаватимуть до Opus 5.
Оцінювання перед релізом
За твердженням Anthropic, Opus 5.5 відповідає Fable 5.1 за продуктивністю у більшості робочих завдань. Перед випуском модель також тестували зовнішні партнери, серед яких Frontier Design і METR.
Компанія планує випустити моделі Claude Sonnet 5.5 та Haiku 5.5 протягом найближчих тижнів.