Telset.id – OpenAI dilaporkan memecat sejumlah kontraktor yang bertugas melatih model AI-nya karena menggunakan AI untuk mengerjakan pekerjaan mereka sendiri. Laporan 404 Media mengungkap bahwa para pekerja ini dihukum atau dikeluarkan dari proyek setelah ketahuan menyerahkan tugas penilaian dan penyempurnaan respons model kepada chatbot seperti ChatGPT.
Ironi yang mencolok: kontraktor yang dipekerjakan justru untuk menyuplai penilaian manusia terhadap model AI harus berhenti karena menyerahkan penilaian itu kembali ke AI. Aturan tersebut sebenarnya masuk akal. Para pekerja direkrut spesifik karena kemampuan pertimbangan manusianya, sesuatu yang kehilangan nilai bila ChatGPT atau chatbot AI lain yang mengambil keputusan.
Salah satu kontraktor mengaku kepada 404 Media bahwa ia melihat rekan-rekannya memakai AI “sepanjang waktu” dan pekerja memang rutin dikeluarkan karena hal itu. Kontraktor lain membagikan apa yang disebutnya sebagai surat pemutusan hubungan kerja yang menyoroti masalah pada “authenticity” atau keaslian hasil kerja mereka.
Mengapa Umpan Balik Manusia Tetap Krusial
Model AI tidak sekadar belajar dari hasil scraping teks dalam jumlah besar dari buku maupun internet. OpenAI menyatakan informasi yang diberikan atau dihasilkan oleh pelatih manusia dan peneliti adalah salah satu sumber yang digunakan untuk mengembangkan model fondasinya. Umpan balik manusia juga lama berperan dalam mengajarkan model respons mana yang disukai orang dan bagaimana model seharusnya berperilaku.
Konsekuensinya, kualitas umpan balik manusia menjadi benar-benar penting. OpenAI sebelumnya telah mengakui dalam risetnya bahwa model yang dilatih memakai umpan balik manusia bisa dipengaruhi oleh orang-orang yang melabeli data tersebut. Karena itu, mempertahankan manusia dalam proses penilaian menjadi bagian tak terpisahkan dari pengembangan model.
Kontraktor yang dijelaskan oleh 404 Media bekerja di berbagai proyek OpenAI, sebagian di antaranya bisa melibatkan ribuan pekerja. Tugas mereka mencakup membaca respons AI, memberi rating, dan memutuskan jawaban mana yang lebih baik. Namun menurut dokumen internal yang diperoleh 404 Media, reviewer tidak diizinkan mengalihdayakan penilaian itu kembali ke AI.
Seperangkat instruksi yang dilaporkan secara spesifik melarang pekerja memakai AI untuk menulis umpan balik atau komentar, dan secara khusus menyebut alat seperti Grammarly serta AI translation. Mercor, perusahaan pelatihan AI yang mempekerjakan kontraktor untuk proyek-proyek OpenAI, mengonfirmasi kepada 404 Media bahwa kontraknya melarang pekerja menggunakan large language model untuk menyelesaikan proyek.
Baca Juga:
Deteksi AI Tanpa AI Detector
Orang mungkin mengira perusahaan AI akan menangkap pekerja yang memakai AI dengan AI detector. Ternyata tidak. 404 Media tidak mengungkap secara persis bagaimana kontraktor yang dipecat itu tertangkap. Namun instruksi internal yang diperoleh publikasi tersebut menawarkan gambaran menarik tentang bagaimana reviewer diminta mencurigai penggunaan AI. Dan AI detector bukan bagian dari prosesnya.
Instruksi tersebut dilaporkan meminta reviewer tidak menggunakan alat seperti GPTZero karena dianggap tidak andal. Sebagai gantinya, reviewer diminta menilai pola keseluruhan pengajuan seorang pekerja dan mencari petunjuk seperti penulisan berulang, waktu penyelesaian yang luar biasa cepat, serta pola penulisan yang terkait dengan AI. Bahkan penggunaan em dash secara berlebihan bisa memicu kecurigaan.
Reviewer juga dilaporkan diinstruksikan untuk tidak memberi tahu pekerja secara persis apa yang membuat mereka mencurigai penggunaan AI, karena hal itu bisa mempermudah penyembunyian di masa depan. Ini cukup mengungkap prosesnya: orang-orang yang memeriksa apakah manusia diam-diam memakai AI untuk membantu melatih ChatGPT secara eksplisit diminta tidak mempercayai perangkat lunak deteksi AI untuk melakukan tugas itu.

OpenAI memakai banyak data sintetis, yakni informasi yang dihasilkan dengan bantuan model AI, sebagai bagian dari sebagian proses pelatihan. Perusahaan menyatakan data sintetis dapat meningkatkan performa model dan mengisi celah ketika data pelatihan lain langka. Namun hal itu berbeda dari diam-diam menggantikan model AI untuk seseorang yang secara spesifik direkrut guna memberikan umpan balik manusia.
Jika seorang evaluator seharusnya memberi tahu OpenAI respons mana yang disukai manusia, meminta AI lain mengambil keputusan itu meniadakan sebagian besar alasan mempekerjakan evaluator tersebut. Situasi ini tidak berarti insiden tersebut membuat ChatGPT memburuk, dan tidak ada bukti dalam laporan 404 Media bahwa pekerjaan kontraktor yang dihasilkan AI menyebabkan kerusakan terukur pada model OpenAI.
Meski demikian, kasus ini menyingkap salah satu realitas paling aneh dari ledakan AI: bahkan perusahaan yang membangun sistem AI masih membutuhkan manusia untuk memberi tahu sistem tersebut kapan mereka telah menghasilkan sesuatu dengan benar. Hal ini sejalan dengan dinamika lain di industri, seperti ketika Anthropic dan OpenAI mengejar kapasitas infrastruktur untuk mendukung pengembangan model mereka.

Tekanan pada kualitas data pelatihan juga tercermin dari langkah OpenAI membentuk grup penasihat matematika usai kontroversi Navier-Stokes, yang menunjukkan bagaimana perusahaan berupaya menjaga kredibilitas dan akurasi keluaran modelnya di tengah sorotan publik. Dalam konteks itulah aturan larangan memakai AI untuk tugas penilaian manusia menjadi semakin relevan.
Sementara itu, sejumlah persoalan hukum dan privasi turut membayangi OpenAI, termasuk gugatan yang diajukan British Columbia soal penembakan Tumbler Ridge. Rangkaian peristiwa ini menggambarkan bahwa pengelolaan ekosistem AI tidak hanya soal teknologi, tetapi juga tata kelola, akuntabilitas, dan kepercayaan.
Bagi pengguna ChatGPT, laporan ini menegaskan satu hal: nilai sebuah model AI tetap bergantung pada penilaian manusia yang menyertainya. Ketika pekerja yang direkrut untuk menilai justru menyerahkan penilaian itu ke mesin, fondasi yang menjaga kualitas respons model ikut terganggu. Karena itu, menjaga integritas umpan balik manusia tetap menjadi pekerjaan yang tidak bisa digantikan oleh AI itu sendiri.





Komentar
Belum ada komentar.