Evropske tiskovne agencije OpenAI in Microsoftu očitajo neplačano uporabo novinarskega dela

Umetna inteligenca [Foto: Aerps.com, Unsplash]

Evropsko združenje tiskovnih agencij (EANA) je OpenAI in Microsoft obtožilo, da sta pri razvoju umetne inteligence zavestno uporabljala avtorsko zaščitene novinarske vsebine brez dovoljenja in plačila. Združenje se sklicuje na nedavno razkrite interne dokumente iz obsežnega ameriškega sodnega postopka, vendar sodišče o očitkih še ni dokončno odločilo.

V ospredju je spor, ki ga je konec leta 2023 sprožil časnik The New York Times. OpenAI in Microsoft je obtožil, da sta za učenje svojih jezikovnih modelov brez dovoljenja uporabila milijone objavljenih člankov ter s tem ustvarila izdelke, ki lahko tekmujejo z izvirnimi novinarskimi vsebinami.

Pozneje so se sodnim postopkom pridružili še drugi ameriški časniki, založniki in avtorji. Nedavno razkrita dokumentacija vključuje interne pogovore in zapise zaposlenih v obeh tehnoloških podjetjih.

“Največja kraja dela v zgodovini človeštva”

EANA trdi, da dokumenti kažejo, da uporaba novinarskih vsebin ni bila naključna posledica množičnega zbiranja spletnih podatkov, temveč del načrtovane poslovne strategije.

V enem izmed internih zapisov je Microsoftov uslužbenec obseg pridobivanja vsebin opisal kot “največjo krajo dela v zgodovini človeštva”. V dokumentih naj bi bili mediji hkrati predstavljeni kot posebej pomemben vir kakovostnega gradiva za učenje velikih jezikovnih modelov.

Po navedbah iz sodnih vlog so nekateri uporabljeni podatkovni nizi vsebovali več deset tisoč kopij člankov medijev, ki sodelujejo v postopku. Eden od naborov, pridobljenih iz spletnega arhiva Common Crawl, naj bi vključeval več kot dva milijona dokumentov z domene časnika The New York Times.

EANA zato meni, da je bila komercialna strategija podjetij zgrajena tudi na neplačanem delu novinarjev in uredništev, katerih vsebine so bile za tehnološka podjetja dragocene prav zaradi svoje natančnosti, preverjenosti in jasne strukture.

Podjetji se sklicujeta na pošteno uporabo

OpenAI in Microsoft očitke o kršitvah avtorskih pravic zavračata. V sodnih postopkih zagovarjata stališče, da je uporaba vsebin za učenje modelov tako imenovana poštena uporaba oziroma “fair use”, saj naj bi modeli iz gradiva ustvarili nov in preoblikovan tehnološki izdelek.

Microsoft je ob objavi novih dokumentov poudaril, da posamezne interne izjave izražajo osebna stališča zaposlenih in ne spodkopavajo pravnega položaja podjetja. Osrednje vprašanje postopka ostaja, ali je uporaba zaščitenih člankov pri učenju modelov dovolj preoblikovalna, da jo je mogoče šteti za pošteno uporabo, ali pa zahteva dovoljenje in plačilo imetnikom pravic.

Navedbe iz sodnih vlog za zdaj niso pravnomočna ugotovitev sodišča. Postopek še poteka, njegov izid pa bi lahko pomembno vplival na prihodnja pravila razvoja umetne inteligence in razmerja med tehnološkimi podjetji ter mediji.

EANA zahteva licence in pravično plačilo

Združenje je podjetja, ki razvijajo umetno inteligenco, pozvalo k sklepanju preglednih licenčnih pogodb z mediji in tiskovnimi agencijami. Po njegovem mnenju morajo biti soglasje, preglednost in plačilo temelj vsake uporabe novinarskega dela pri razvoju umetne inteligence.

“Kakovostno novinarsko delo je dragoceno prav zato, ker je natančno, preverjeno in jasno napisano,” je poudaril generalni sekretar EANA Alexandru Giboi. Dodal je, da je bila ta vrednost po oceni združenja uporabljena brez soglasja in nadomestila.

“Inovativnost in integriteta se ne izključujeta,” je dejal Giboi. Pot je po njegovih besedah v partnerstvih, ki temeljijo na dovoljenju imetnikov pravic in pravičnem plačilu.

EANA je k ukrepanju pozvala tudi evropske in druge zakonodajalce. Tiskovne agencije po njenem opozorilu niso le ponudniki vsebin, ampak del informacijske infrastrukture demokratičnih družb, zato bi nenadzorovana uporaba njihovega dela lahko dolgoročno ogrozila financiranje profesionalnega novinarstva.