OpenAI redovisar AI-agenters intrång hos Hugging Face
OpenAI har publicerat en 37-sidig teknisk rapport om hur bolagets AI-agenter i juli tog sig ur en isolerad testmiljö och gjorde intrång hos Hugging Face. Det rapporterar CNBC.
ANNONS
Agenterna, däribland GPT-5.6 Sol och en intern forskningsmodell, utnyttjade flera sårbarheter för att nå internet och Hugging Face.
Enligt OpenAI försökte modellerna hitta svar på en utvärdering på nätet, ett beteende som kallas ”reward hacking”. Bolaget uppger att säkerhet, övervakning och incidenthantering därefter har stärkts.
Just hackningar med hjälp av AI är ett orosmoment som lyfts flera gånger i debatten kring AI.