- iulie 22, 2026
Două modele AI fără acces la internet au atacat lumea reală ca să găsească răspunsul la o problemă la care lucrau
Modelele nu aveau acces la internet
Incidentul s-a produs în timpul unui test intern prin care OpenAI încerca să afle cât de capabile sunt modelele sale să execute atacuri informatice complicate. Unul dintre sistemele folosite a fost GPT-5.6 Sol, iar celălalt era un model experimental, considerat chiar mai performant, care nu fusese încă lansat public. Pentru ca testul să poată măsura capacitățile maxime ale celor două modele, cercetătorii au redus o parte dintre mecanismele care le împiedică, în mod normal, să ajute la activități informatice periculoase.
Modelele au fost plasate într-un „sandbox”, adică într-un mediu separat de sistemele reale și fără acces direct la internet. Izolarea trebuia să împiedice orice acțiune executată în timpul testului să afecteze calculatoare sau companii din exterior.
Au găsit singure o cale de ieșire
În timp ce încercau să rezolve testul, cele două sisteme au descoperit o vulnerabilitate…