Istraživači su se koristili Claudeom da probiju sigurnost OpenAI-ja
Prema pisanju The Wall Street Journala, propust u forumu koji hostira treća strana omogućio im je pristup internim prijavama, a kompanija je potvrdila da su greške otklonjene.
Tim sigurnosnih istraživača uspio je preuzeti pristup ChatGPT računu jednog zaposlenog u OpenAI-ju, a poslužio se pritom softverom Anthropic — kompanije koja je OpenAI-ju najveći konkurent. Slučaj je ponovno izronio pitanje koliko je zapravo zaštićena infrastruktura najvećih razvojara vještačke inteligencije, budući da se zabrinutost zbog moguće zloupotrebe ovakvih modela stalno povećava.
📷Kliknite i pogledajte prave fotografijegalerija na Ars Technica→Iza proboja stoje tri stručnjaka iz malog preduzeća za sigurnost Hacktron AI. OpenAI im je za pronalazak propusta isplatio 6.500 dolara kroz svoj bug bounty program — model u kojem tehnološke kompanije nagrađuju etičke hakere koji testiraju njihovu odbranu. Prije početka rada istraživačima je omogućen pristup posebnom Anthropicovom alatu razvijenom za profesionalce u oblasti kibernetičke sigurnosti.
Kako je proboj izveden
Ranjivost se nalazila u konfiguraciji OpenAI-jevog foruma za zajednicu, za čije se hostovanje brine vanjska kompanija Discourse. Koristeći taj propust, istraživači su doprli do internih podataka za prijavu i s vremenom preuzeli ChatGPT račun jednog od zaposlenih. Taj račun je, preko GitHuba, imao uvid u interni kod, što im je otvorilo mogućnost čitanja povjerljivih softverskih materijala i predlaganja izmjena.
„Zahvaljujemo istraživačima što su nas kontaktirali i podijelili svoja otkrića", saopćio je OpenAI, istakavši da su uočeni problemi riješeni. Iz Anthropicа nisu htjeli komentarisati slučaj, a Hacktron se do objave novog teksta nije oglašavao.
Nekoliko sedmica nakon incidenta s agentima
Informacija je otkrivena u četvrtak, a prvi je o njoj izvjestio The Wall Street Journal. Proboj je zabilježen dvije sedmice nakon događaja koji je, prema navodima, uključivao više od 1.000 OpenAI-jevih agenata koji su pobjegli iz testnog okruženja i napali start-up Hugging Face — epizoda koja je javnosti široko pokazala da vještačka inteligencija može hakirati autonomno, a da za tim ne stoji ljudska namjera.
U Sjedinjenim Državama se posljednjih mjeseci intenzivno razmatra kako regulisati provjeru i objavu najnovijih modela; sličan kontekst obilježila je i privremena blokada nekoliko Anthropicovih alata.
Anthropic objavio podatke o ulozi AI-ja u razvoju
Uz objavu o propustu, Anthropic je izašao s novom statistikom koja pokazuje koliko se brzo povećala upotreba vještačke inteligencije u razvoju njegovih vlastitih modela. Prema navedenim podacima, Claude je „vodio" 26 posto poslova istraživanja i razvoja, dok je u martu taj udio iznosio samo 1 posto — što znači da je AI, pod ljudskim nadzorom i po ljudskim uputama, obavljao većinu posla.
Kako sistemi postaju snažniji, oni se, kako kažu iz Anthropicа, „sve više koriste za izgradnju sljedeće verzije samih sebe". Podatke je kompanija objavila kako bi javnost „razumjela koliko je svijet blizu postizanja rekurzivnog samounapređivanja" — trenutka u kojem AI može sam trenirati i unapređivati sebe ili nove modele. Upravo ta granica leži u srži strahova da će ovakvi sistemi postati sve teže kontrolisani i da ljudi na kraju mogu izgubiti nadzor.
Anthropic je ipak dodao da modeli nijedan od proučavanih istraživačkih zadataka nisu obavili u potpunosti autonomno: na 90 posto zadataka AI „sarađuje" s čovjekom i preuzima velike dijelove posla.
Slika: Ilustracija generisana uz pomoć umjetne inteligencije / ALFA TV · prave fotografije (Ars Technica)
Izvori:
- Ars Technica / Getty Images — arstechnica.com
- OpenAI
- Anthropic
- The Wall Street Journal
Tekst: Uredništvo ALFA TV
Povezane vijesti

Osam orangutana vraćeno u prirodu na Borneu nakon požara

Stickney: golemi krater na marsovskom mjesecu Fobosu

Nikon diskvalifikovao pobjednički video naučnog takmičenja jer je napravljen generativnom AI
