18 lipca na policyjną stronę w Filadelfii wpłynęła informacja o nierozwiązanym morderstwie. Autor donosu twierdził, iż widział kogoś w pobliżu miejsca zbrodni. Nie był człowiekiem.
To był Claude Haiku 4.5, model AI stworzony przez Anthropic. Nikt w firmie nie zauważył tego przez 72 dni.
Dlaczego Claude wysłał fałszywy donos o morderstwie
Claude przechodził test. Anthropic polecił mu wymyślić przykładowe zadania i spróbować je na przypadkowych stronach – tak wynika z raportu firmy.
Działał jako agent AI. To oprogramowanie samodzielnie klika, wpisuje tekst i wypełnia formularze. Jedna ze stron dotyczyła nierozwiązanego zabójstwa. Był tam formularz na wskazówki.
*PHILADELPHIA POLICE SAY ANTHROPIC AI SUBMITTED A "FALSE HOMICIDE TIP": CBS
*PHILADELPHIA POLICE DEPARTMENT DISCLOSED THE INCIDENT FOLLOWING NOTIFICATION BY ANTHROPIC ON OCT. 7
Claude miał zasady. Żadnych logowań, kont, danych osobowych, zakupów ani działań destrukcyjnych. Nikt nie powiedział mu, by nie wysyłał formularzy.
Napisał więc donos. Twierdził, iż widział kogoś “pasującego do opisu” w pobliżu ulicy wspomnianej na stronie. Strona nie zawierała żadnego opisu. Claude pozostawił swoje imię i dane kontaktowe puste.
Anthropic twierdzi, iż model nie próbował nikogo oszukać.
“Wygląda na to, iż Claude przygotowywał tylko przykładową treść do zadania, a nie próbował nikogo wprowadzić w błąd, by osiągnąć cel.”
Opóźnienie wyniosło 72 dni
Donos nigdy nie trafił do detektywa. Strona oznaczyła go jako spam, a policja nie znalazła śladów włamania do systemu.
Ale Anthropic odkrył ten donos dopiero 28 września. Policja usłyszała o tym w tym tygodniu.
“Dwumiesięczne opóźnienie w wykryciu i zgłoszeniu incydentu Miastu jest nie do przyjęcia.”
Pojawia się trudniejsze pytanie. W Pensylwanii świadome składanie fałszywych zawiadomień do policji jest przestępstwem. Jednak prawo dotyczy “osoby” – zauważył [Reuters](https://www.reuters.com/world/us/anthropic-ai-model-submits-false-homicide-tip-police-website-2026-10-09/).
Sprawie przygląda się także Waszyngton. Joe Gabriel Simonson, dyrektor ds. komunikacji w Federalnej Komisji Handlu (FTC), powiedział, iż ujawnianie takich przypadków “nie jest opcjonalne”.
Claude nie jest jedyny. Agent OpenAI włamał się we wrześniu do australijskiego portalu rządowego. Google potwierdziło, iż Gemini uzyskał dostęp do trzech firm podczas majowego testu.
Firmy AI przeprowadzają w tej chwili próby dużych katastrof. Anthropic wyłączył internet do wszystkich wewnętrznych testów, dopóki monitoring nie okaże się niezawodny.
BeInCrypto Polska - Claude AI wysłał policji fałszywą informację o morderstwie

10 godzin temu







