Tvrtka je objavila opsežnu zbirku studija slučaja u kojima dokumentira načine na koje su njezini trenutni AI modeli bili zloupotrijebljeni.
Anthropic je otkrio i zaustavio nekoliko znanstvenika koji su njegove AI modele koristili za razvoj potencijalnog biološkog oružja, prema novom izvješću koje je tvrtka objavila u četvrtak. „Biološka zloupotreba” samo je jedna od zabrinjavajućih vrsta korištenja AI-ja koje izvješće dokumentira, no postaje sve važnija tema jer noviji modeli poput Fable 5 postaju sve sposobniji u potpori znanstvenim istraživanjima.
Izvješće obuhvaća pet studija slučaja u kojima su Anthropicovi modeli korišteni za razvoj biološkog oružja, uz opis sigurnosnih mjera koje su upozorile tvrtku na zloupotrebu i načina na koji je reagirala. Otkrivanje moguće zloupotrebe iznimno je složeno, kako je tvrtka naglasila za The New York Times, jer istraživanje novog cjepiva može izgledati gotovo identično razvoju biološkog oružja. U svim slučajevima tvrtka kaže da je zbog mogućih posljedica birala pretjeranu opreznost.
„Ne radi se o tome da netko, kao u stripu, kaže: ‘Hej, želim napraviti biološko oružje i pobiti sve'”, rekao je Jacob Klein, voditelj odjela za obavještavanje o prijetnjama u Anthropicu, za The New York Times. „Situacija je nevjerojatno složena.”
U jednoj studiji slučaja iz svibnja Anthropic navodi da je njegov „klasifikator biološke sigurnosti” označio zahtjev u kojemu je od Claudea traženo da napiše prijedlog istraživačkog granta za istraživanje dobitka funkcije na virusu chikungunya. Taj virus nema licenciranog liječenja i može uzrokovati onesposobljavajuće simptome koji traju tjednima ili mjesecima, ističe tvrtka. Istraživanje dobitka funkcije proučava metode genetske modifikacije organizama, a u slučaju ovog virusa predloženi grant predviđao je povećanje njegove prenosivosti i sposobnosti izbjegavanja imunosnog odgovora. Kombinacija zvuči opasno, a Anthropic dodaje da je sumnju dodatno pojačala činjenica da je predloženo istraživanje bilo povezano s vojnim istraživačkim institutom.
Tvrtka je slično reagirala i na istraživanje dobitka funkcije vezano uz ptičju gripu, kao i na zaseban slučaj u kojemu je istraživač koristio Claude za razvoj atlasa otrovnih toksičnih peptida i „generativnog cjevovoda koji je optimizirao karakteristike toksina”. Cjelovito izvješće uključuje i studije slučaja u kojima su Anthropicovi modeli korišteni kao alat za nadzor, za stvaranje softverskih exploita, propagande i oružnih sustava.
Prema navodima tvrtke, svima koji su zloupotrijebili Claude ili druge Anthropicove modele ukinuti su korisnički računi, a spoznaje iz istraga koriste se za daljnje unapređenje zaštitnih mehanizama modela i sprječavanje budućih zloupotreba. S obzirom na osjetljivost teme biološke zloupotrebe, Anthropic ne otkriva identitete pojedinaca ni institucija koje je istraga dovela u vezu s razvojem mogućeg biološkog oružja. „Osobe koje se spominju u ovim studijama slučaja aktivni su znanstvenici”, navodi Anthropic. „Ne tvrdimo da su imali namjeru nanijeti štetu, a njihovo bi identificiranje ili otkrivanje njihovih laboratorija moglo ugroziti njihovu sigurnost.”
Izvor: Engadget







