Tanggung Jawab Hukum Pembuat Model Ai Atas Pelanggaran Hak Cipta Dalam Data Scraping

Alvian Putra Prianto

Mahasiswa Ilmu Hukum Universitas Pamulang

Pendahuluan

Perkembangan kecerdasan buatan (Artificial Intelligence/AI) dalam satu dekade terakhir telah mengubah secara fundamental cara manusia menciptakan, memproses, dan mendistribusikan informasi. Model-model AI generatif seperti large language model (LLM) dan model generasi gambar kini mampu memproduksi konten yang menyerupai karya manusia dalam hitungan detik. Di balik kemampuan luar biasa ini, terdapat satu kebutuhan mendasar yang kerap luput dari perhatian publik: kebutuhan akan data pelatihan dalam jumlah masif.

Untuk melatih model AI yang andal, perusahaan-perusahaan teknologi melakukan pengumpulan data dalam skala besar melalui praktik yang dikenal sebagai data scraping, yaitu pengambilan konten secara otomatis dari berbagai sumber di internet, termasuk artikel berita, buku digital, karya sastra, kode perangkat lunak, hingga karya seni visual. Praktik ini menimbulkan pertanyaan hukum yang serius: apakah penggunaan karya-karya yang dilindungi hak cipta sebagai data pelatihan model AI merupakan bentuk pelanggaran hak cipta? Dan jika terjadi pelanggaran, siapakah yang bertanggung jawab secara hukum?

Hukum Indonesia melalui Undang-Undang Nomor 28 Tahun 2014 tentang Hak Cipta memberikan perlindungan bagi pencipta atas karya-karyanya. Namun, rezim hak cipta yang ada belum secara eksplisit mengatur posisi hukum dari aktivitas data scraping untuk keperluan pelatihan AI. Ketidakjelasan norma inilah yang menjadi titik sentral kajian opini hukum ini.

Persoalan / Permasalahan

Permasalahan hukum utama dalam kajian ini berpusat pada apakah aktivitas data scraping yang dilakukan pembuat model AI terhadap karya-karya yang dilindungi hak cipta dapat dikualifikasikan sebagai pelanggaran Undang-Undang Nomor 28 Tahun 2014 tentang Hak Cipta (selanjutnya disebut UUHC).

Pasal 9 UUHC memberikan hak eksklusif kepada pencipta atau pemegang hak cipta untuk melakukan penggandaan, penerjemahan, dan pengadaptasian atas ciptaannya. Data scraping secara teknis melibatkan penyalinan (copying) konten secara sistematis. Pertanyaannya adalah apakah penyalinan dalam konteks pelatihan model AI dapat diklasifikasikan sebagai tindakan yang memerlukan izin dari pencipta, atau apakah ia masuk ke dalam pengecualian yang dikenal sebagai “fair use” atau penggunaan yang dibenarkan berdasarkan Pasal 43 dan 44 UUHC.

Persoalan kedua adalah pertanggungjawaban hukum. Pembuat model AI umumnya merupakan korporasi atau entitas berbadan hukum. Jika data scraping yang dilakukan terbukti melanggar hak cipta, apakah tanggung jawab melekat pada pengembang algoritmanya, perusahaan yang mengelola platform, atau keduanya secara tanggung renteng? Ketidakjelasan alokasi tanggung jawab ini menjadi celah hukum yang berpotensi merugikan pencipta.

Kisah Nyata: Gugatan Penulis dan Penerbit terhadap Perusahaan AI

Persoalan data scraping dan hak cipta bukan sekadar perdebatan akademis. Secara global, sejumlah gugatan nyata telah diajukan terhadap perusahaan-perusahaan pengembang model AI terkemuka. Di Amerika Serikat, penulis-penulis ternama seperti John Grisham, George R.R. Martin, dan Jodi Picoult bersama lebih dari 10.000 penulis lain yang tergabung dalam Authors Guild mengajukan gugatan pada tahun 2023 terhadap OpenAI. Mereka mendalilkan bahwa model GPT yang dikembangkan OpenAI dilatih dengan menggunakan buku-buku karya mereka tanpa izin dan tanpa kompensasi.

Gugatan serupa juga diajukan oleh The New York Times terhadap OpenAI dan Microsoft pada Desember 2023. Surat kabar bergengsi tersebut mendakwa bahwa jutaan artikel jurnalistik mereka digunakan sebagai data pelatihan untuk model AI tanpa persetujuan. Gugatan ini signifikan karena menunjukkan bahwa karya yang dihasilkan model AI dapat secara verbatim mereproduksi konten yang dilindungi hak cipta, sehingga berpotensi menggantikan sumber aslinya di pasar.

Meskipun gugatan-gugatan tersebut berlangsung di yurisdiksi Amerika Serikat, relevansinya terhadap hukum Indonesia tidak dapat diabaikan. Indonesia sebagai pengguna aktif platform-platform AI global dan produsen konten digital yang terus berkembang menghadapi risiko yang sama: karya-karya pencipta Indonesia berpotensi telah atau akan digunakan sebagai data pelatihan model AI tanpa izin. Perkembangan ini mendesak pemerintah dan pembentuk norma untuk segera merumuskan respons hukum yang memadai.

Pendapat Penulis

Menurut pendapat penulis, aktivitas data scraping yang dilakukan untuk keperluan pelatihan model AI terhadap karya-karya yang dilindungi hak cipta pada prinsipnya merupakan tindakan yang memerlukan izin pencipta berdasarkan Pasal 9 UUHC. Penggandaan sistematis atas konten yang dilindungi, meskipun dilakukan secara otomatis oleh mesin dan tujuannya bukan untuk distribusi langsung kepada publik, tetap merupakan bentuk reproduksi yang memerlukan lisensi atau persetujuan dari pemegang hak.

Dalil bahwa pelatihan AI masuk ke dalam kategori penggunaan yang dibenarkan berdasarkan Pasal 44 UUHC, khususnya penggunaan untuk keperluan ilmu pengetahuan dan riset, memerlukan pengujian yang ketat. Ketentuan tersebut seharusnya ditafsirkan secara sempit dan tidak boleh meluas sedemikian rupa sehingga melegitimasi eksploitasi komersial skala besar terhadap karya cipta. Model-model AI yang dikembangkan oleh korporasi besar dan dipasarkan secara komersial jelas tidak memenuhi syarat “nirlaba” yang menjadi salah satu tolok ukur pembatasan hak cipta.

Mengenai pertanggungjawaban, penulis berpendapat bahwa tanggung jawab hukum melekat pada perusahaan atau pengembang yang secara aktif merancang, menjalankan, dan mengkomersilkan sistem AI yang bersangkutan. Pasal 1365 KUHPerdata tentang perbuatan melawan hukum dapat menjadi dasar gugatan perdata, sementara Pasal 113 UUHC mengatur sanksi pidana bagi pelanggar hak cipta. Keduanya dapat diterapkan secara bersamaan terhadap korporasi yang terbukti melakukan atau membiarkan terjadinya pelanggaran hak cipta dalam proses pelatihan AI.

Solusi

Pertama, pemerintah perlu segera mengamandemen atau menerbitkan peraturan pelaksana UUHC yang secara eksplisit mengatur posisi hukum data scraping untuk pelatihan AI. Regulasi tersebut perlu menetapkan dengan jelas apakah diperlukan lisensi wajib (compulsory license), mekanisme opt-out bagi pencipta, atau sistem kompensasi kolektif yang dikelola oleh lembaga manajemen kolektif.

Kedua, perusahaan pengembang model AI yang beroperasi di Indonesia atau menggunakan konten dari sumber Indonesia wajib menerapkan mekanisme data provenance yang transparan, yaitu pencatatan terperinci mengenai sumber data yang digunakan dalam pelatihan. Transparansi ini diperlukan agar pencipta dapat mengidentifikasi apakah karyanya digunakan tanpa izin dan menuntut haknya.

Ketiga, pemerintah Indonesia perlu aktif berpartisipasi dalam forum-forum internasional seperti WIPO untuk mendorong pembentukan instrumen hukum internasional yang mengatur hak cipta dalam konteks AI. Sebagai negara dengan ekosistem konten digital yang berkembang pesat, Indonesia memiliki kepentingan nyata dalam memastikan pencipta lokal mendapatkan perlindungan yang setara di era kecerdasan buatan.

Penutup

Data scraping untuk pelatihan model AI adalah praktik yang secara teknis memungkinkan kemajuan teknologi, namun secara hukum bersinggungan langsung dengan hak-hak eksklusif pencipta yang dijamin oleh Undang-Undang Nomor 28 Tahun 2014 tentang Hak Cipta. Ketidakhadiran norma yang eksplisit mengatur hubungan antara AI dan hak cipta menciptakan ketidakpastian hukum yang merugikan pencipta dan berpotensi menghambat iklim kreativitas nasional.

Gugatan-gugatan yang terjadi di berbagai belahan dunia menunjukkan bahwa komunitas pencipta tidak berdiam diri menghadapi praktik ini. Indonesia perlu mengambil posisi hukum yang jelas sebelum sengketa serupa muncul dan sistem hukum nasional tidak mampu memberikan respons yang memadai. Kemajuan teknologi AI tidak boleh dicapai dengan mengorbankan hak-hak pencipta yang telah diakui dan dilindungi oleh hukum. Oleh karena itu, pembentukan regulasi yang komprehensif, transparan, dan berkeadilan bagi semua pihak adalah suatu keniscayaan yang tidak dapat ditunda lebih lama.