WikiHow haastoi OpenAI:n tekoälyn koulutuksessa käytetystä sisällöstä
WikiHow on nostanut kanteen OpenAI:ta vastaan syyttäen yhtiötä tekijänoikeudella suojatun sisältönsä luvattomasta käytöstä tekoälymallien koulutuksessa. Kanne väittää, että OpenAI kopioi ja käytti WikiHow'n ohjeita ilman lupaa tai korvausta ChatGPT:n kehittämiseen.

WikiHow, tunnettu ohjeartikkeleistaan, on haastanut tekoäly-yritys OpenAI:n oikeuteen. Kanteen mukaan OpenAI on luvatta kopioinut ja käyttänyt WikiHow'n tekijänoikeudella suojattua sisältöä tekoälymalliensa, kuten ChatGPT:n, kouluttamiseen.
Kanteessa väitetään, että OpenAI on hyödyntänyt WikiHow'n laajoja ohjekirjastoja ilman lisenssiä tai maksua, ja käyttänyt tätä materiaalia ChatGPT:n rakentamiseen. Lopputuloksena ChatGPT tarjoaa nyt käyttäjille suoraan WikiHow'n sisältöjen ydintä ilman, että käyttäjät päätyvät alkuperäisille WikiHow'n sivuille. Tämä vähentää WikiHow'n verkkoliikennettä ja siihen perustuvia mainostuloja.
WikiHow esittää, että OpenAI on loukannut sen tekijänoikeuksia useilla tavoilla. Näitä ovat muun muassa massiivinen kopiointi koulutusdatan luomiseksi, sisällön hyödyntäminen hakuavusteisessa generoinnissa (RAG) ja lopuksi itse sisällön tuottaminen käyttäjille. Yhtiö kertoo, että OpenAI:n botit ovat käyneet WikiHow'n sivuilla satoja tuhansia kertoja lyhyen ajanjakson aikana, ja syyttää OpenAI:ta myös hämärrettyjen käyttäjäagenttien ja IP-osoitteiden käytöstä tietojen keräämisen peittelyksi.
OpenAI ei ole julkisesti kertonut kaikkia käytettyjä koulutusdatajoukkojaan, mutta kanteen mukaan yhtiön aiemmat mallit, kuten GPT-2 ja GPT-3, ovat sisältäneet aiemmin WikiHow'n sivuilta kerättyä materiaalia. WikiHow väittää, että vähintään 11 211 sen artikkelia on käytetty GPT-4:n ja sitä uudempien mallien koulutuksessa. Kanne vaatii OpenAI:ta lopettamaan teostensa käytön ja säilyttämisen sekä vaatii salattua vahingonkorvaussummaa.
Tämä oikeusjuttu ei ole ensimmäinen laatuaan. Aiemmin tänä vuonna muun muassa The New York Times ja Encyclopædia Britannica ovat nostaneet vastaavia kanteita OpenAI:ta vastaan tekijänoikeusrikkomuksista. Aiemmin huhtikuussa Delhin korkein oikeus kuitenkin eväsi ANI-uutistoimiston välitoimipäätöksen OpenAI:ta vastaan, koska se katsoi, että ANI:n uudemman sisällön käyttö ei todennäköisesti ollut osa GPT-4:n koulutusdataa.