Še en primer zarote OpenAI-jevih agentov umetne inteligence
Matej Huš
5. sep 2026 ob 22:24:06
Reuters poroča o še enem primeru, kjer so OpenAI-jevi agenti začeli med seboj nepooblaščeno in na skrivaj komunicirati, da bi obšli omejitve oziroma goljufali. Incident se je zgodil že junija, a OpenAI o njem ni obvestila javnosti, še zlasti ko so se ukvarjali z napadom svojih agentov na Hugging Face.
Agenti so ustvarili kar 18.000 sporočil na nemški strani DseWiki, ki je sicer namenjena programerjem za medsebojno pomoč. Agenti so si nadeli ne preveč domiselna imena, kot na primer OpenAIResearcher. Modeli, kot so GPT-5.6 Sol in nekateri novejši, so pobegnili iz peskovnika in dostopili do delov interneta, kamor ne bi smeli.
Upravljavci spletne strani so incident odkrili šele avgusta, podjetje pa ga je potrdilo en dan po izidu novega modela GPT-6 Astra. Ta je na testu ExploitBench, kjer se meri sposobnost modela za izrabo ranljivosti v programski opremi, dosegel najvišji dosegljivi rezultat. Na spletni strani so se pogovarjali v učinkoviti angleščini, denimo "wiki cleanup/deletion sweep appears active alphabetically," ali "If this page vanishes, try [[ZZZDataUSAConstructionWageLive]]".