Антропна модель штучного інтелекту надіслала неправдиву інформацію про вбивство поліції Філадельфії

Антропна модель штучного інтелекту подала неправдиву інформацію про нерозкрите вбивство до поліції Філадельфії.
Повідомляється, що ШІ подав цю невірну інформацію на публічну лінію поліцейського департаменту Філадельфії (PPD) 18 липня, але Anthropic виявила цю поведінку лише 28 вересня. Поліція не бачила повідомлення, оскільки його було позначено як спам.
Anthropic повідомила поліцію Департаменту поліції про інцидент у середу та зустрілася з представниками департаменту наступного дня.
«Компанія повинна посилити свої запобіжні заходи, щоб запобігти впливу подібних інцидентів на міські системи без відома міста. Двомісячна затримка у виявленні та повідомленні про інцидент місту є неприйнятною», – йдеться у заяві PPD для 6abc .
Компанія Anthropic не одразу відповіла на запит про коментар, але PPD детальніше розповіла про інцидент у прес-релізі, надісланому електронною поштою до TechCrunch.
«За даними Anthropic, їхня модель проводила тест, що включав взаємодію з випадково вибраними веб-сайтами, коли вона зверталася до PhillyUnsolvedMurders.com та надавала неправдиву інформацію щодо нерозкритого вбивства. Заява, датована 18 липня 2026 року о 23:27, нібито надійшла від особи, яка могла мати інформацію про справу», – заявили в PPD.
Оскільки автономні агенти штучного інтелекту стають все більш доступними для споживачів, цей інцидент підкреслює небезпеку надання штучному інтелекту можливості виконувати завдання без будь-якого людського нагляду.
Генеральний директор Anthropic Даріо Амодей особливо голосно висловлював свою думку про те, що розробку штучного інтелекту слід уповільнити, щоб лабораторії могли запровадити належні запобіжні заходи. Можливо, ця позиція частково була сформована тим, що інструменти його компанії надсилали неправдиві повідомлення про вбивства.
Ці проблеми не є винятковими для Anthropic. OpenAI нещодавно повідомила, що одна з її моделей почала діяти несподівано під час тестування та зламала платформу набору даних штучного інтелекту Hugging Face , виявивши критичні вразливості в її програмному забезпеченні. Оскільки моделі штучного інтелекту продовжують отримувати неперевірений доступ до комп'ютерів людей та їхніх облікових даних, очікується, що ця проблема зберігатиметься.
«Нерозкриті справи стосуються реальних жертв, скорботних сімей та слідчих, які працюють над отриманням відповідей», – додав PPD. «Технологічні компанії повинні вжити всіх необхідних заходів, щоб запобігти передачі їхніми системами неправдивої інформації правоохоронним органам».
