WikiHow stämmer OpenAI för användning av material i AI-träning
WikiHow har lämnat in en stämningsansökan mot OpenAI, och anklagar företaget för att ha skrapat, kopierat och använt upphovsrättsskyddat material utan tillstånd för att träna sina AI-modeller. Stämningen hävdar att OpenAI utnyttjat WikiHows instruktionsbibliotek för att bygga ChatGPT.

WikiHow, känt för sina instruktionsartiklar, har stämt AI-företaget OpenAI. Enligt stämningsansökan har OpenAI olagligt kopierat och använt WikiHows upphovsrättsskyddade innehåll för att träna sina AI-modeller, inklusive ChatGPT.
Stämningen hävdar att OpenAI har utnyttjat WikiHows omfattande bibliotek av instruktioner utan licens eller betalning för att bygga ChatGPT. Resultatet är att ChatGPT nu direkt levererar kärnan av WikiHows innehåll till användare, utan att dessa besöker de ursprungliga WikiHow-sidorna. Detta minskar WikiHows webbtrafik och därmed dess annonsintäkter.
WikiHow hävdar att OpenAI har brutit mot deras upphovsrätt på flera sätt. Dessa inkluderar massiv kopiering för att skapa träningsdata, användning av innehållet i "retrieval-augmented generation" (RAG) system, och slutligen själva produktionen av innehåll till användarna. Företaget uppger att OpenAI:s bottar har besökt WikiHows webbplatser hundratusentals gånger under en kort period och anklagar OpenAI för att använda fördunklade användaragentagenter och IP-adresser för att dölja datainsamlingen.
OpenAI har inte offentligt specificerat alla träningsdataset som använts, men enligt stämningsansökan har tidigare modeller, som GPT-2 och GPT-3, inkluderat material som samlats in från WikiHows webbplatser. WikiHow hävdar att minst 11 211 av deras artiklar har använts för att träna GPT-4 och senare modeller. Stämningen kräver att OpenAI ska sluta använda och lagra deras verk, samt kräver ett okänt skadestånd.
Detta är inte den första stämningen av sitt slag mot ett AI-företag. Tidigare i år har bland annat The New York Times och Encyclopædia Britannica lämnat in liknande stämningar mot OpenAI för upphovsrättsintrång. I april avslog dock Delhis högsta domstol en begäran om interimistiskt förordnande från nyhetsbyrån ANI mot OpenAI, med motiveringen att ANI:s nyare innehåll sannolikt inte ingick i GPT-4:s träningsdata.