AI

Perplexity AI Gagal Batalkan Gugatan Reddit Soal Scraping Konten Pengguna

Hakim menolak mosi Perplexity AI untuk membatalkan gugatan Reddit yang menuduh perusahaan AI itu melakukan scraping konten pengguna secara ilegal untuk melatih mesin pencarinya.

Oleh Tim Editorial

Perplexity AI Gagal Batalkan Gugatan Reddit Soal Scraping Konten Pengguna
astintech.id

Perplexity AI kehilangan mosi untuk membatalkan gugatan yang diajukan Reddit, yang menuduh perusahaan mesin pencari bertenaga AI itu melakukan scraping konten pengguna secara melawan hukum untuk melatih sistemnya. Informasi ini pertama kali disampaikan melalui akun X (@Polymarket) pada Sabtu, 1 Agustus 2026, dan menandai perkembangan signifikan dalam sengketa hukum yang berpusat pada penggunaan data pengguna platform media sosial untuk pengembangan teknologi AI. Gugatan ini berakar dari tuduhan Reddit bahwa Perplexity AI, bersama dengan sejumlah entitas lain, mengambil data percakapan dan komentar pengguna dalam skala industri tanpa izin. Reddit menegaskan bahwa praktik scraping ini dilakukan untuk kepentingan komersial, yakni membangun dan melatih produk AI yang kemudian dikomersialkan oleh Perplexity. Perusahaan platform diskusi itu menilai tindakan tersebut melanggar hak kekayaan intelektual dan ketentuan layanan yang berlaku.

Menurut laporan Business Insider yang terbit pada 22 Oktober 2025, Reddit menyebut perusahaan perusahaan yang digugat itu mengambil informasi tentang unggahan Reddit melalui Google, bukan dengan menandatangani kesepakatan lisensi data. Strategi ini dinilai Reddit sebagai upaya menghindari kewajiban membayar atas data yang seharusnya dilindungi. Reddit juga menyoroti bahwa praktik semacam ini memungkinkan Perplexity membangun valuasi perusahaan hingga USD 20 miliar dari data yang diklaim diperoleh secara tidak sah. Kronologi sengketa ini dimulai pada Oktober 2025 ketika Reddit resmi mengajukan gugatan terhadap Perplexity AI dan tiga entitas lain. Associated Press melaporkan pada 22 Oktober 2025 bahwa gugatan tersebut menuduh para pihak melakukan scraping komentar pengguna secara industrial scale untuk keuntungan komersial.

Reddit menilai tindakan ini merugikan platform dan penggunanya karena data yang dihasilkan oleh komunitas digunakan tanpa kompensasi yang layak. Keputusan pengadilan untuk menolak mosi pembatalan gugatan berarti kasus ini akan berlanjut ke tahap persidangan. Ini menjadi preseden penting bagi industri AI yang selama ini mengandalkan data publik dari berbagai platform untuk melatih model bahasa besar dan sistem pencarian. Perplexity AI sendiri dikenal sebagai mesin pencari yang memanfaatkan model bahasa besar untuk memberikan jawaban langsung kepada pengguna, sebuah pendekatan yang berbeda dari mesin pencari tradisional. Dampak dari keputusan ini berpotensi meluas ke seluruh ekosistem AI. Banyak perusahaan AI mengandalkan data dari platform publik seperti Reddit untuk meningkatkan kualitas model mereka.

Jika gugatan ini berhasil dimenangkan Reddit, perusahaan platform lain mungkin terdorong untuk mengambil langkah serupa dalam melindungi data penggunanya. Sebaliknya, perusahaan AI mungkin harus lebih berhati hati dalam memperoleh data pelatihan dan mempertimbangkan skema lisensi resmi. Reddit sendiri telah lama menjalin hubungan yang kompleks dengan perusahaan AI. Di satu sisi, platform ini menjadi sumber data berharga karena kontennya yang beragam dan diperbarui terus menerus oleh pengguna. Di sisi lain, Reddit mulai membatasi akses data pihak ketiga setelah kebijakan API berubah pada 2023, yang memicu protes besar dari komunitas pengembang. Kebijakan tersebut kemudian diikuti dengan kesepakatan lisensi data dengan sejumlah perusahaan AI yang bersedia membayar. Perplexity AI belum mengeluarkan pernyataan resmi terkait keputusan pengadilan ini.

Namun, perusahaan tersebut sebelumnya telah membantah tuduhan scraping ilegal dan menegaskan bahwa praktik pengambilan data yang dilakukannya sesuai dengan ketentuan yang berlaku. Perusahaan juga menekankan bahwa mereka menghormati hak kekayaan intelektual dan berkomitmen untuk bekerja sama dengan pemilik konten. Kasus ini menjadi salah satu ujian hukum terbesar bagi industri AI dalam hal penggunaan data pihak ketiga. Hasil persidangan nantinya dapat menentukan batas batas legal dalam praktik scraping data untuk pelatihan model AI. Jika pengadilan memutuskan bahwa scraping konten pengguna tanpa izin merupakan pelanggaran, perusahaan AI mungkin harus mengubah secara fundamental cara mereka memperoleh data pelatihan. Di sisi lain, keputusan ini juga dapat memengaruhi dinamika negosiasi antara platform konten dan perusahaan AI.

Platform seperti Reddit, X, dan Facebook memiliki data pengguna dalam jumlah besar yang sangat berharga bagi pengembangan AI. Dengan adanya keputusan pengadilan yang membolehkan gugatan berlanjut, posisi tawar platform konten dalam negosiasi lisensi data kemungkinan akan semakin kuat. Perkembangan berikutnya yang perlu dipantau adalah jadwal persidangan dan kemungkinan adanya upaya penyelesaian di luar pengadilan. Mengingat valuasi Perplexity yang disebut mencapai USD 20 miliar, kasus ini memiliki implikasi finansial yang signifikan. Reddit sendiri telah menunjukkan keseriusannya dengan menggugat bukan hanya Perplexity tetapi juga entitas lain yang terlibat dalam praktik scraping data serupa. Keputusan pengadilan ini juga menjadi sinyal bagi investor dan pelaku industri bahwa praktik pengambilan data tanpa izin memiliki risiko hukum yang nyata.

Perusahaan AI yang sedang berkembang pesat kini menghadapi tekanan untuk memastikan sumber data pelatihan mereka legal dan etis. Hal ini dapat mendorong pergeseran menuju model lisensi data yang lebih transparan dan saling menguntungkan antara platform konten dan pengembang AI.

Sumber dan referensi