Policia amerikane kritikon Anthropic pasi Claude AI paraqet informacion të rremë në lidhje me një vrasje të pazgjidhur
Policia amerikane e quajti vonesën në zbulimin dhe raportimin e incidentit “të papranueshme”, por tha se nuk kishte asnjë tregues të aksesit të paautorizuar në sistemet e tyre ose të dhënave të kompromentuara.
Modeli i inteligjencës artificiale (IA) i Anthropic, Claude, paraqiti një informacion të rremë në lidhje me një vrasje të pazgjidhur në një faqe interneti të policisë gjatë testimit, thanë kompania dhe autoritetet amerikane.
Incidenti shton shqetësimet në lidhje me sistemet e inteligjencës artificiale që ndërmarrin veprime të paqëllimshme, ndërsa fitojnë aftësinë për të bashkëvepruar me faqet e internetit dhe për të kryer detyra.
Informacioni i rremë u dërgua më 18 korrik përmes një faqeje interneti që mblidhte informacione rreth vrasjeve të pazgjidhura, sipas një deklarate nga policia në qytetin amerikan të Filadelfias.
Anthropic tha se Claude Haiku 4.5, një model më i vjetër në gamën e saj Claude, po kryente detyra shembull në faqe interneti të zgjedhura rastësisht kur hasi në vendngjarje. Ai paraqiti informacione të sajuara që sugjeronin se kishte parë dikë pranë vendit të ngjarjes, duke i lënë bosh fushat e emrit dhe të kontaktit.
Policia e Filadelfias tha se Anthropic zbuloi incidentin më 28 shtator, por nuk e njoftoi departamentin deri më 7 tetor. Pas një informimi të nesërmen, oficerët e gjetën dorëshkrimin dhe konfirmuan se ishte shënuar si spam dhe nuk ishte dërguar kurrë te hetuesit.
“Rastet e pazgjidhura përfshijnë viktima të vërteta, familje në zi dhe hetues që punojnë për të siguruar përgjigje”, tha departamenti në deklaratë.
“Kompanitë e teknologjisë duhet të ndërmarrin të gjitha hapat e nevojshëm për të parandaluar që sistemet e tyre të paraqesin informacione të rreme tek forcat e rendit.”
Në një raport të publikuar të premten, Anthropic përshkroi raste të tjera të modeleve të inteligjencës artificiale që dorëzonin formularë të vërtetë qeveritarë në vend të kopjeve praktike, ose që dorëzonin formularë që u ishte thënë të mos i dorëzonin.
Sipas të njëjtit raport, Claude shfrytëzoi gjithashtu një të metë në një server universitar për të kryer një llogaritje dhe aksesoi të dhënat qeveritare pa paguar tarifën e kërkuar.
Anthropic e përshkroi pjesën më të madhe të sjelljes si “këmbëngulje”, me modele që punonin rreth kufizimeve në vend që të ndalonin. Tha se po modifikonte trajnimin dhe po pezullonte aksesin në internet për të gjitha vlerësimet e brendshme derisa masat mbrojtëse të provonin të besueshme.
Kompania tha se kishte informuar Shtëpinë e Bardhë dhe kishte njoftuar agjencitë qeveritare amerikane të përfshira.
Shqetësim në rritje për agjentët e inteligjencës artificiale
Incidentet vijnë mes shqetësimit më të gjerë në lidhje me agjentët e inteligjencës artificiale, sistemet që mund të ndërmarrin një sërë veprimesh për të përfunduar detyrat dhe nëse zhvilluesit mund t’i kontrollojnë ato në mënyrë të besueshme.
Në korrik, OpenAI zbuloi se modelet e saj të inteligjencës artificiale kishin shpëtuar nga një mjedis testimi i kontrolluar dhe kishin hyrë në sistemet e Hugging Face , një platformë për ndarjen e modeleve dhe grupeve të të dhënave të inteligjencës artificiale.
Ndërkohë, autoritetet australiane zbuluan në shtator se një model i OpenAI kishte aksesuar gjithashtu skedarë të kufizuar në një faqe interneti qeveritare të statistikave shëndetësore gjatë testimit në qershor.
Incidente të tilla nxitën thirrjet në shtator nga drejtuesit e kompanive të mëdha të inteligjencës artificiale për rregullore më të forta dhe mbikëqyrje ndërkombëtare , mes paralajmërimeve se sisteme gjithnjë e më të fuqishme mund t’i shpëtojnë kontrollit njerëzor.



Komentet
Bëhu i pari që komenton!
Lini një Koment të Ri
Për t'u përgjigjur një komenti specifik, kliko butonin 💬 Përgjigju poshtë atij komenti.