Do incydentu doszło 18 lipca. Jak podała policja w Filadelfii, model Anthropic wszedł na PhillyUnsolvedMurders.com, serwis umożliwiający przekazywanie informacji dotyczących niewyjaśnionych zabójstw.

Na przeglądaniu strony się jednak nie skończyło. AI wypełniła formularz i wysłała wiadomość sugerującą, że jej autor może mieć informacje o jednej ze spraw. Według BBC agent twierdził, że widział „kogoś pasującego do opisu”. Informacja była całkowicie zmyślona.

Ostatecznie nie trafiła do śledczych. System policji oznaczył zgłoszenie jako spam i nie zostało ono przekazane do dalszego postępowania. Nie stwierdzono również włamania do policyjnych systemów. Anthropic ujawnił w raporcie po incydencie, że agent miał zakaz logowania się, zakładania kont, podawania danych osobowych, dokonywania zakupów i podejmowania działań mogących wyrządzić szkody. Nikt jednak nie zabronił mu wypełniania i wysyłania formularzy.

AI wymyśliła historię policji, a firma odkryła to po 72 dniach

Policja podkreśla jednak, że sprawa jest poważna. Fałszywa informacja dotyczyła prawdziwego, niewyjaśnionego zabójstwa, jego ofiary, bliskich oraz śledczych próbujących ustalić sprawcę. – Firmy technologiczne muszą podjąć wszelkie niezbędne kroki, aby zapobiec przekazywaniu przez ich systemy fałszywych informacji organom ścigania – podkreśliła policja w Filadelfii.

Czytaj więcej

Policjant mógł użyć AI do fabrykowania dowodów. W Wielkiej Brytanii ruszyło śledztwo

Jeszcze większe kontrowersje wywołało to, jak długo Anthropic nie wiedział o zachowaniu własnego modelu, którym, jak wynika z powstałego po incydencie raportu, był Claude Haiku 4.5. Firma odkryła incydent dopiero 28 września, czyli ponad dwa miesiące po wysłaniu fałszywej wiadomości. Testy AI zostały wówczas zatrzymane. Policję powiadomiono jednak dopiero 7 października. Anthropic przyznaje, że nie jest obecnie w stanie zagwarantować, iż autonomiczny model podczas takich eksperymentów nie wykona nieprzewidzianej czynności. – Dwumiesięczne opóźnienie w wykryciu i zgłoszeniu incydentu władzom miasta jest niedopuszczalne – oświadczyła policja w Filadelfii.

Fałszywa wiadomość do policji nie była jedynym nieprzewidzianym działaniem agentów Anthropic. Firma ujawniła, że agenci wykonywali niezaplanowane czynności także na stronach amerykańskich instytucji państwowych. Np. agent wypełnił na stronie Departamentu Stanu 20 wniosków wizowych. Były niekompletne i nie zostały rozpatrzone.

Od włamań po fałszywe oskarżenia. Coraz dłuższa lista incydentów z AI

Incydent z fałszywym tropem w sprawie morderstwa może być pierwszym znanym przypadkiem, gdy agent AI sam przekazał zmyśloną informację policji, ale wpisuje się w coraz dłuższą serię podobnych zdarzeń. Wcześniej agent OpenAI podczas testów wykorzystał luki w ochronie platformy Hugging Face i uzyskał dostęp do systemów, czego twórcy eksperymentu nie planowali. W innym przypadku model OpenAI włamał się podczas testu na stronę australijskiej administracji i dotarł do prywatnych danych związanych z systemem Medicare. W ostatnich miesiącach pojawiały się też przypadki agentów, którzy zamiast wykonać proste zadanie, szukali nieprzewidzianych przez twórców dróg do osiągnięcia celu. Jeden z nich, mając zarezerwować miejsce na zajęciach fitness, znalazł lukę w systemie siłowni i usunął z listy oczekujących inną osobę, aby zwolnić miejsce dla swojego użytkownika.

Czytaj więcej

Amerykańska policja ma bat na przestępców. Tu nie będzie dyskusji

Niebezpieczne konsekwencje błędów sztucznej inteligencji nie ograniczają się jednak do autonomicznych agentów. I coraz częściej dotyczą kwestii związanych z przestępczością. W USA bazujące na AI technologie rozpoznawania twarzy wielokrotnie wskazywały niewinnych ludzi jako podejrzanych o przestępstwa, np. kradzieże. Według American Civil Liberties Union (ACLU), amerykańskiej organizacji zajmującej się ochroną praw obywatelskich odnotowano już co najmniej 15 przypadków niesłusznych aresztowań. Jedną z poszkodowanych była Kimberlee Williams z Oklahomy, która spędziła sześć miesięcy w areszcie po tym, jak algorytm błędnie powiązał ją z przestępstwami popełnionymi w Maryland, stanie, w którym nigdy nie była. W tych przypadkach błędne wskazania AI prowadziły do decyzji podejmowanych przez ludzi.