wikiHow baru saja menggugat OpenAI karena melakukan pengambilan (scraping) lebih dari 11.000 artikel cara melakukan (how-to) untuk melatih ChatGPT tanpa izin atau pembayaran. Gugatan tersebut diajukan di SDNY (Perkara 1:26-cv-07171). Dalam gugatannya, wikiHow menuduh OpenAI mengambil konten secara langsung dan melalui Common Crawl, lalu tetap melakukan perayapan meski wikiHow memblokir GPTBot dan OAI-SearchBot lewat robots.txt pada 2023/2025.
Inti tuduhan teknisnya: ChatGPT kini menghasilkan respons how-to yang saling bersaing dan mereproduksi substansi wikiHow hampir kata demi kata, sehingga menggerus kunjungan halaman (pageviews) dan pendapatan iklan. wikiHow juga mengklaim OpenAI menghapus informasi manajemen hak cipta (judul, byline, pemberitahuan) yang melanggar DMCA.
Pembelaan OpenAI: "data yang tersedia untuk umum + fair use." Namun, gugatan tersebut berpendapat bahwa efek substitusi (pengganti) menghilangkan insentif ekonomi untuk memproduksi konten asli.
Ini bagian dari gelombang gugatan hak cipta yang lebih besar terhadap perusahaan AI terkait praktik data pelatihan. Pertanyaan hukumnya pada akhirnya: apakah doktrin fair use mencakup pengambilan komersial skala besar terhadap materi berhak cipta untuk pelatihan model ketika keluaran secara langsung bersaing dengan sumber?
Menarik secara teknis karena menguji batas antara "belajar dari data publik" dan "penyalinan komersial yang menggusur karya asli." Pelanggaran robots.txt juga menjadi data apakah perusahaan AI menghormati arahan perayapan (crawl directives) atau mengabaikannya ketika itu dirasa menguntungkan.
Inti tuduhan teknisnya: ChatGPT kini menghasilkan respons how-to yang saling bersaing dan mereproduksi substansi wikiHow hampir kata demi kata, sehingga menggerus kunjungan halaman (pageviews) dan pendapatan iklan. wikiHow juga mengklaim OpenAI menghapus informasi manajemen hak cipta (judul, byline, pemberitahuan) yang melanggar DMCA.
Pembelaan OpenAI: "data yang tersedia untuk umum + fair use." Namun, gugatan tersebut berpendapat bahwa efek substitusi (pengganti) menghilangkan insentif ekonomi untuk memproduksi konten asli.
Ini bagian dari gelombang gugatan hak cipta yang lebih besar terhadap perusahaan AI terkait praktik data pelatihan. Pertanyaan hukumnya pada akhirnya: apakah doktrin fair use mencakup pengambilan komersial skala besar terhadap materi berhak cipta untuk pelatihan model ketika keluaran secara langsung bersaing dengan sumber?
Menarik secara teknis karena menguji batas antara "belajar dari data publik" dan "penyalinan komersial yang menggusur karya asli." Pelanggaran robots.txt juga menjadi data apakah perusahaan AI menghormati arahan perayapan (crawl directives) atau mengabaikannya ketika itu dirasa menguntungkan.
