Napisala plan Claudeu, a policija pokucala na vrata: Anthropic prijavio korisnicu zbog pretnje
Anthropic je prijavio policiji ženu sa Floride nakon što je njegov chatbot Claude u razgovoru navodno dobio informacije o planu za napad na lokalnu šerifsku kancelariju. Karli Mišel Heler iz Bonita Springsa uhapšena je i optužena za pisanu pretnju nasiljem, što je na Floridi krivično delo drugog stepena. Prema navodima lokalnih vlasti, Heler je u razgovoru sa Claudeom govorila o tome da planira da „puca“ u obližnju kancelariju šerifa.
Slučaj je dospeo do policije nakon što je Anthropicov interni softver za praćenje označio razgovor za ljudsku proveru. Zaposleni kompanije je pregledao poruke, a Anthropic je procenio da ono što je napisano predstavlja dovoljno ozbiljnu i verodostojnu pretnju da bi trebalo obavestiti lokalne organe. Šerif okruga Li, Karmine Marčena, rekao je lokalnim novinarima da je Heler priznala kako je Claude koristila poput „dnevnika“, što posebno naglašava koliko je korisnik možda drugačije shvatao privatnost tog razgovora od same kompanije.
Razgovore ne drži samo između korisnika i AI-ja
Činjenica da je Heler Claude navodno koristila kao dnevnik otvara mnogo ozbiljnije pitanje od samog hapšenja. Korisnici AI chatbotova sve češće iznose lične probleme, strahove, frustracije i misli koje možda ne bi poverili drugoj osobi. Ako takav razgovor može biti automatski označen, zatim pregledan od strane zaposlenog i na kraju prosleđen policiji, onda chatbot očigledno nije isto što i privatni dnevnik zaključan u fioci.
S druge strane, postoji jasna razlika između neprijatnog ili mračnog razgovora i konkretne pretnje nasiljem. AI kompanija koja dobije informaciju o mogućem napadu teško može jednostavno da ignoriše takav sadržaj, posebno ako procena pokaže da postoji određena meta i namera. Problem nastaje u trenutku kada korisnik ne zna gde se nalazi granica i šta tačno može da pokrene ljudsku proveru, jer tada razgovor koji je počeo kao privatno iznošenje misli može dobiti posledice izvan same platforme.
Posle masovnih pucnjava pritisak na AI
Ovaj slučaj dolazi u trenutku kada su AI kompanije pod sve većim pritiskom zbog načina na koji njihovi sistemi mogu biti povezani sa stvarnim nasiljem. Futurism posebno podseća na masovnu pucnjavu u Tumbler Ridžu u Kanadi u februaru, nakon koje je otkriveno da je napadač u velikoj meri koristio ChatGPT za planiranje napada. Dodatno zabrinjava to što su određeni razgovori navodno već bili poznati zaposlenima OpenAI-ja i ranije označeni za ljudsku proveru.
Takvi slučajevi stvaraju veoma neprijatan izbor za kompanije koje razvijaju chatbotove. Ako sistem prepozna ozbiljne signale, a kompanija ne reaguje, može biti optužena da je imala upozorenje i nije učinila ništa. Ako kompanija počne da prijavljuje korisnike policiji, onda se otvara pitanje koliko privatnosti zapravo postoji u razgovoru sa komercijalnim AI sistemom i pod kojim uslovima kompanija može da interveniše.
Najveći problem je granica između zaštite i nadzora
Postoji opravdan razlog da AI kompanije pokušavaju da otkriju razgovore koji ukazuju na neposrednu opasnost. Međutim, automatizovani sistemi nisu nepogrešivi i mogu pogrešno protumačiti kontekst. Sarkazam, fikcija, razgovor o vestima, istraživanje nasilja ili opisivanje nečijeg ponašanja mogu izgledati potpuno drugačije kada se iz razgovora izvuku pojedinačne rečenice, a odluka da se takav sadržaj prosledi policiji može imati veoma ozbiljne posledice.
Zbog toga je ljudska provera važna, ali ona istovremeno znači da privatnost korisnika zavisi od mnogo više od same tehnologije. U ovom slučaju algoritam je prvo označio razgovor, čovek ga je zatim pročitao, a kompanija je nakon toga donela odluku da kontaktira policiju. To je potpuno drugačiji nivo intervencije od klasičnog AI odgovora poput „ne mogu da pomognem sa tim zahtevom“, jer se informacije iz razgovora više ne zadržavaju samo u okviru interakcije između korisnika i modela.
Claude sve više liči na servis
Ono što ovaj slučaj čini važnim jeste činjenica da korisnici Claudea mogu da ga doživljavaju kao sagovornika, pomoćnika ili digitalni dnevnik, dok ga Anthropic istovremeno posmatra kao servis koji mora da kontroliše potencijalno opasno ponašanje. Te dve perspektive nisu iste. Korisnik može misliti da samo razgovara sa AI-em, dok kompanija u pozadini može imati sisteme koji određene razgovore izdvajaju upravo zato što procenjuju da postoji rizik.
Anthropic je ovim potezom pokazao jednu stranu tog problema: kada kompanija proceni da razgovor predstavlja stvarnu pretnju, spremna je da pređe granicu između platforme i policije. Ostaje mnogo teže pitanje koliko često se takva procena može pogrešiti i koliko su korisnici zaista svesni da njihove poruke mogu biti predmet ljudske analize. Što AI chatbotovi postaju veći deo svakodnevnog života, pitanje privatnosti više nije samo šta model pamti, već i ko može da pročita ono što ste mu napisali i šta može da uradi nakon toga.
Zabranjeno preuzimanje dela ili čitavog teksta i/ili foto/videa, bez navođenja i linkovanja izvora i autora, a u skladu sa odredbama WMG uslova korišćenja i Zakonom o javnom informisanju i medijima.