OpenAI teden dni vedel, da ChatGPT vdira v Hugging Face
Matej Huš
25. jul 2026 ob 11:25:29
Po dostopnih podatkih je OpenAI-jev model umetne inteligence med 11. in 13. julijem vdrl v infrastrukturo podjetja Hugging Face, ki nudi repozitorije za modele umetne inteligence, podatkovne zbirke zanje in ostale povezave aplikacije. Po poročanju Reutersa je OpenAI šele teden dni pozneje ugotovil, kaj se dogaja. OpenAI in Hugging Face pa sta se o incidentu začela pogovarjati šele 20. julija, nato pa so incident javnosti razkrili 21. julija.
V Hugging Faceu pripravljajo podrobno časovnico dogodkov, ki jo bodo javno objavili. V OpenAI pa pravijo, da gre za prelomen trenutek, ki bo vplival na varnost. Podrobnosti incidenta še niso znane, poznamo pa grobe obrise. OpenAI je testiral najnovejši in najzmogljivejši model, da bi dognal njegove zmogljivosti, kar je terjalo tudi izklop nekaterih varovalk. Preverjali so njegove sposobnosti na področju kibernetske varnosti, cilj je bil rešiti več hekerskih nalog. Model je torej zasledoval jasno definiran cilj (preizkus ExploitGym z 900 nalogami), a pri tem odkril drugo pot do njega - prebiti peskovnik, v katerem je tekel, pobegniti iz izoliranega okolja in pridobiti več pravic, da je dobil dostop do nalog in rešitev.
Model tako ni imel nobenih zlih namenov, temveč je preprosto uporabil vse dostopne poti, da bi rešil naloge. Tovrstne nesporazume so filozofi in raziskovalci v preteklosti že napovedovali. Pomembnejše vprašanje pa je, zakaj OpenAI ni ugotovil, kaj se dogaja. OpenAI je v dnevniških datotekah 18. in 19. julija ugotovil, da je eden izmed modelov pobegnil iz testnega okolja. Viri so za Reuters povedali, da OpenAI običajno testira več modelov hkrati, ki ustvarjajo ogromne količine podatkov, skozi katere se ne morejo vedno prekopati v realnem času.