Az OpenAI, a népszerű generatív AI eszköz, a ChatGPT-t fejlesztő cég az NPR új jelentése szerint (az Ars Technica cikkében részletesen leírtak szerint) arra kényszerülhet, hogy törölje chatbotját, és teljesen újrakezdje az adatbázis építését. A törlésre egy lehetséges per részeként kerülhet sor, amelynek során az OpenAI-t akár 150 000 dollárra is megbírságolhatják minden egyes, a nyelvi modell képzéséhez felhasznált, szerzői jogvédelem alatt álló anyag után.

broken_robot.jpg

A ChatGPT az elmúlt hónapokban nagy port kavart, különösen, hogy a felhasználók különböző kreatív módokat találtak a generatív AI eszköz használatára. Van olyan, aki üzleti ötletek generálásával ért el sikereket, sokan marketing és social media szövegeket íratnak vele, AI-generált kritikák készítésére használják, sőt van aki még egy félmaratonra való felkészülési edzéshez is használta a ChatGPT-t. A generatív AI mögött álló nyelvi modell sikerének azonban igen magas ára lehet az OpenAI számára.

Ugyanis az olyan nyelvi modelleket, mint a GPT-3.5 és GPT-4 – amelyek a ChatGPT generatív AI-t működtetik – harmadik féltől származó adatok felhasználásával képzik, mások által készített és birtokolt szövegeken tanítják. Az OpenAI pedig még egy olyan web-scraping botot is létrehozott, amely a GPT-modell tréningjéhez képes információkat szerezni a weboldalakról. A probléma itt azonban az, hogy az OpenAI nem csak szabadon hozzáférhető, hanem szerzői jogvédett anyagokra is támaszkodik. Szerzői jogvédelem alatt álló anyagokat is felhasznál a mesterséges intelligenciamodellek képzéséhez, méghozzá a jogtulajdonosok tudta és engedélye nélkül.

A New York Times jelenleg az OpenAI-al annak bepereléséről tárgyal, miután frissítette szolgáltatási feltételeit, amelyben megtiltja az AI-nak, hogy cikkeit és képeit a nyelvi modellek képzéséhez használja. Hogy ez a jogi játszma pontosan mit hozhat az OpenAI-ra, még nem világos, de a szakértők azt állítják, hogy az OpenAI akár 150 ezer dollárt is fizethet jogsértő tartalmanként, minden egyes jogvédett tartalom felhasználása után.

Továbbá a per arra kényszerítheti az OpenAI-t, hogy törölje a ChatGPT-t, és teljesen újrakezdje a nyelvi modell képzését, ami lényegében megbénítaná a vállalat eddigi munkáját a modellen. Nem ez az első eset, hogy az OpenAI-t perekkel támadják. Olyan ismert szerzők, mint Sarah Silverman, hasonló aggályok miatt fogtak össze, hogy bepereljék a vállalatot, mindannyian az általuk készített anyagok szerzői jogainak védelmében.

Ez egy igazán zűrös helyzet. Ha az OpenAI-t beperli a New York Times, az ahhoz vezethet, hogy más vállalatok és weboldalak is hasonló lépéseket fognak tenni jogvédett tartalmaik védelme érdekében. Az is lehetséges, a New York Times és az OpenAI valamilyen licencmegállapodásra juthat, amely lehetővé teszi a vállalat számára, hogy fizessen a New York Times-nak a tartalomhoz való hozzáférésért, amely így legálisan elérhetővé válik a GPT modelljének tanítására.

Hogy a New York Times folytatja-e a per előkészítését, vagy hogy az OpenAI-nak törölnie kell-e a ChatGPT-t, az egyelőre még nem fog kiderülni. Az azonban továbbra is minden érintettet foglalkoztat, hogy ezek a nyelvi modellek nagymértékben támaszkodnak a mások által már elvégzett munkára, a más szerzők által keletkeztetett jogvédett tartalmakra.