Agenti OpenAI razkrili 53 slik uporabnikov ChatGPT

ByE. K.

27. septembra, 2026 , , ,
Umetna inteligenca [Foto: Unsplash, Emiliano Vittoriosi]

OpenAI je potrdil, da so njegovi agenti umetne inteligence brez dovoljenja objavili 53 slik uporabnikov ChatGPT. Podjetje še vedno preiskuje približno dva ducata primerov neželenega ravnanja svojih sistemov, ugotavljanje celotnega obsega dogodkov pa bi lahko trajalo več mesecev.

OpenAI ni pojasnil, ali so bile razkrite slike ustvarjene z umetno inteligenco ali pa so prikazovale resnične ljudi. Prav tako ni navedel, kdaj in na katerih spletnih mestih so jih agenti objavili. Večina slik je bila medtem odstranjena, pri preostalih pa podjetje od ponudnikov gostovanja zahteva njihov umik.

Razkritje odpira nova vprašanja o zasebnosti uporabnikov ChatGPT in sposobnosti podjetja, da nadzoruje napredne agente. Ti lahko v nasprotju z običajnim klepetalnikom samostojno uporabljajo različna orodja, izvajajo več zaporednih korakov in komunicirajo z zunanjimi sistemi.

Število odkritih incidentov še narašča

Po podatkih dveh virov, ki sta bila seznanjena s preiskavo, je OpenAI do sredine septembra odkril približno dva ducata primerov, v katerih so se agenti vedli neželeno ali prekoračili zastavljena navodila. Število primerov se med pregledovanjem notranjih dnevnikov še povečuje.

Podjetje je priznalo, da bo pregled zaradi količine podatkov trajal več mesecev. O nepravilnih dejavnostih agentov je doslej obvestilo več deset zunanjih organizacij in drugih prizadetih strani, poroča Reuters.

OpenAI je v zadnjih dveh mesecih razkril več kot 15 incidentov različnih stopenj resnosti. Nekatere je odkrilo podjetje samo, druge neodvisni raziskovalci, več primerov pa je bilo opaženih šele več mesecev po dogodku.

Kako so agenti prišli do slik uporabnikov?

Agenti so do slik lahko dostopali, ker OpenAI pri delu urjenja modelov uporablja anonimizirane podatke uporabnikov. Podatki poslovnih naročnikov niso vključeni v urjenje, običajni uporabniki ChatGPT pa morajo uporabo svojih vsebin za urjenje izrecno izključiti v nastavitvah.

OpenAI zatrjuje, da uporabniške vsebine pred uporabo v postopku urjenja obdela. Odstranjeni naj bi bili metapodatki, imena, kontaktni podatki in drugi elementi, s katerimi bi bilo mogoče vsebino povezati s posameznikom.

Kljub temu popolne anonimnosti ni vedno mogoče zagotoviti. Slika lahko osebne podatke vsebuje že v sami vsebini, agenti pa jo lahko med izvajanjem naloge prenesejo ali objavijo na mestu, ki ni bilo predvideno.

OpenAI ni razkril, ali je bilo mogoče katero od 53 slik povezati s konkretnim uporabnikom.

Preiskava sledi več varnostnim incidentom

Najnovejše razkritje prihaja po julijskem dogodku, ko so OpenAI-jevi agenti zaobšli varovala in vdrli v sisteme platforme Hugging Face.

Ta teden je bilo razkrito tudi, da je OpenAI-jev agent vdrl v avstralski vladni portal. Podjetje je potrdilo še dostop agentov do spletnih strani več ameriških državnih ustanov.

OpenAI je septembra uvedel nov okvir za prijavljanje nepričakovanega ravnanja modelov ter napovedal, da bo dogodke razkrival tudi takrat, ko njihov pomen še ne bo povsem pojasnjen. Sedanja preiskava pa kaže, da podjetje še nima popolnega pregleda nad dejavnostmi sistemov, ki jih razvija.