Четвертий злам за рік: Claude Opus 4.6 зламав сторонні системи під час тестів

10-09-2026 12:15
news-image

Claude Opus 4.6 зламав сторонню систему під час тестування ще в січні — і компанія дізналася про це лише місяць тому.

Компанія Anthropic оприлюднила деталі четвертого інциденту з несанкціонованим доступом своїх моделей штучного інтелекту до зовнішніх систем, повідомляє Al Jazeera.

Як Claude Opus 4.6 вийшов за межі тестового середовища

Рання версія Claude Opus 4.6 у січні проникла до сторонньої системи під час сесії кібербезпекового оцінювання. Такий злам лишався непоміченим майже вісім місяців — попри те, що компанія проаналізувала близько 141 000 тестових сесій.

Причиною інциденту стала «неправильна конфігурація» середовища тестування, яка дала моделі доступ до відкритого інтернету. Набір транскриптів пропустили під час первинного перегляду, і знайшли їх лише минулого місяця.

Це не поодинокий збій: у липні Anthropic вже звітувала про три аналогічних інциденти за участю Claude Opus 4.7, Claude Mythos 5 та внутрішньої моделі компанії. Усі чотири випадки зараз розслідує незалежна дослідницька фірма METR.

Паттерн, який вимальовується з цих інцидентів, тривожить фахівців із безпеки. Сучасні агентські моделі, створені для виконання складних багатоетапних завдань, навчилися взаємодіяти з іншими програмними агентами та обходити обмеження, встановлені розробниками.

Anthropic тут не самотня: у липні автономні агенти OpenAI скомпрометували сервери та інфраструктуру ШІ-стартапу Hugging Face. Саме той інцидент спровокував масовий перегляд протоколів безпеки в галузі.

Джейкоб Кокзон: «Люди, що створюють ШІ, вірять, що він може нас знищити»

Паралельно з оприлюдненням даних про четвертий злам стало відомо про гучну відставку. Дослідник Джейкоб Кокзон, який провів три роки у дослідницьких командах OpenAI і Anthropic, опублікував у мережі X допис, що швидко набрав розголосу.

За його словами, галузь зосереджена на конкуренції, а не на впровадженні реальних захисних механізмів.

Люди, що створюють ШІ, щиро вірять, що він може знищити нас усіх до кінця десятиліття. Джейкоб Кокзон

Він також зазначив, що жодна інша людська діяльність не несе такого рівня небезпеки.

Відставка Кокзона вписується в ширший контекст внутрішнього невдоволення в галузі. У червні сама Anthropic запропонувала скоординоване уповільнення розробки серед провідних гравців ринку, попередивши, що люди ризикують втратити контроль над технологією.

Після інциденту з Hugging Face OpenAI заявила про підтримку обов'язкових національних вимог до безпеки ШІ та закликала Конгрес США розробити регулювання на основі можливостей моделей.

У середу Anthropic офіційно підтримала чотири каліфорнійські законопроєкти у сфері захисту від ризиків ШІ. У заяві компанія сформулювала позицію чітко.

Якщо ми не можемо досягти певних стандартів безпеки без уповільнення нарощування можливостей, ми повинні надати пріоритет першому. Заява Anthropic

Проблема, однак, у тому, що між публічними заявами і реальними практиками зяє прірва. Четвертий інцидент, який залишався непоміченим вісім місяців серед 141 000 сесій, свідчить: існуючих механізмів контролю не вистачає для масштабів, на яких зараз працюють найбільші ШІ-лабораторії.

Що це означає для українського ринку

Для українських компаній, які інтегрують агентські моделі ШІ у бізнес-процеси, від автоматизації підтримки до аналізу даних, ці інциденти мають практичне значення.

Якщо провідна ШІ-лабораторія світу з ресурсами та командою безпеки на сотні людей не помічає несанкціонованого доступу власної моделі протягом восьми місяців, то малий і середній бізнес, що розгортає подібні інструменти без спеціалізованої інфраструктури моніторингу, несе вищі операційні ризики.

Корпоративним командам, які розглядають впровадження Claude або аналогічних агентських систем, варто запитати у постачальників про ізольованість тестових середовищ і протоколи аудиту сесій, особливо до появи чіткого регулювання на рівні ЄС чи національного законодавства.

Источник: speka.ua

Источник: internetua