Telset.id – Sejumlah kontraktor yang dipekerjakan untuk membantu melatih model AI OpenAI dilaporkan dipecat atau dikeluarkan dari proyek karena menggunakan AI untuk mengerjakan tugas mereka sendiri. Laporan dari 404 Media mengungkap bahwa pekerja yang seharusnya memberikan penilaian manusia justru memakai ChatGPT atau chatbot AI lain untuk menyelesaikan pekerjaan mereka.
Aturan ini sebenarnya masuk akal. Para pekerja tersebut direkrut khusus karena kemampuan penilaian manusia mereka, sesuatu yang menjadi jauh kurang berguna jika ChatGPT atau chatbot AI lain yang melakukan penilaian tersebut. OpenAI sendiri menyatakan bahwa informasi yang diberikan atau dihasilkan oleh pelatih dan peneliti manusia merupakan salah satu sumber yang digunakan untuk mengembangkan model fondasi mereka.

Umpan balik manusia telah lama berperan dalam mengajarkan model respons mana yang lebih disukai orang dan bagaimana model tersebut harus berperilaku. Hal ini membuat kualitas umpan balik manusia menjadi sangat penting. OpenAI sebelumnya telah mengakui dalam riset mereka bahwa model yang dilatih menggunakan umpan balik manusia dapat dipengaruhi oleh orang-orang yang melabeli data tersebut.
Salah satu kontraktor mengungkapkan kepada 404 Media bahwa mereka melihat orang menggunakan AI “sepanjang waktu” dan pekerja secara rutin dikeluarkan karena melakukannya. Kontraktor lain membagikan apa yang mereka sebut sebagai surat pemutusan hubungan kerja yang menyebutkan masalah dengan “keaslian” pekerjaan mereka.
Bagaimana OpenAI Mendeteksi Penggunaan AI
Anda mungkin mengira perusahaan AI akan menangkap pekerja yang menggunakan AI dengan detektor AI. Ternyata tidak. 404 Media tidak mengungkapkan secara pasti bagaimana kontraktor yang dipecat tertangkap. Namun instruksi internal yang diperoleh publikasi tersebut menawarkan pandangan menarik tentang bagaimana reviewer diminta untuk mengenali dugaan penggunaan AI.
Yang mengejutkan, detektor AI bukan bagian dari proses tersebut. Instruksi tersebut dilaporkan memberitahu reviewer untuk tidak menggunakan alat seperti GPTZero karena dianggap tidak dapat diandalkan. Sebagai gantinya, reviewer diminta menilai pola keseluruhan pengajuan pekerja dan mencari petunjuk seperti kata-kata berulang, waktu penyelesaian yang tidak wajar cepat, dan pola penulisan yang terkait dengan AI. Bahkan penggunaan em dash yang berlebihan dapat menimbulkan kecurigaan.
Reviewer juga dilaporkan diinstruksikan untuk tidak memberitahu pekerja secara persis apa yang membuat mereka mencurigai penggunaan AI, karena hal itu bisa memudahkan untuk bersembunyi di masa depan. Ini cukup mengungkap tentang prosesnya: orang-orang yang memeriksa apakah manusia diam-diam menggunakan AI untuk membantu melatih ChatGPT secara eksplisit diminta untuk tidak mempercayai perangkat lunak deteksi AI untuk melakukannya.
Baca Juga:
Kontraktor yang dijelaskan oleh 404 Media bekerja di berbagai proyek OpenAI, beberapa di antaranya dapat melibatkan ribuan pekerja. Pekerjaan mereka dapat mencakup membaca respons AI, menilainya, dan memutuskan jawaban mana yang lebih baik. Namun menurut dokumen internal yang diperoleh 404 Media, reviewer tidak diizinkan untuk mengalihdayakan penilaian itu kembali ke AI.
Satu set instruksi dilaporkan melarang pekerja menggunakan AI untuk menulis umpan balik atau komentar dan secara spesifik menyebut alat termasuk Grammarly dan terjemahan AI. Mercor, perusahaan pelatihan AI yang mempekerjakan kontraktor yang bekerja pada proyek OpenAI, mengonfirmasi kepada 404 Media bahwa kontrak mereka melarang pekerja menggunakan model bahasa besar untuk menyelesaikan proyek.

Data Sintetis dan Batas Penggunaan AI
OpenAI menggunakan banyak data sintetis, yaitu informasi yang dihasilkan dengan bantuan model AI, sebagai bagian dari beberapa proses pelatihan. Perusahaan menyatakan data sintetis dapat meningkatkan performa model dan mengisi celah di mana data pelatihan lain langka. Namun hal itu berbeda dari diam-diam menggantikan model AI untuk seseorang yang secara khusus dipekerjakan untuk memberikan umpan balik manusia.
Jika seorang evaluator seharusnya memberitahu OpenAI respons mana yang lebih disukai manusia, meminta AI lain untuk membuat keputusan itu menghilangkan sebagian besar tujuan mempekerjakan evaluator tersebut. Model AI tidak hanya belajar dari mengikis sejumlah besar teks dari buku atau internet.
Ini tidak berarti insiden tersebut telah membuat ChatGPT lebih buruk, dan tidak ada bukti dalam laporan 404 Media bahwa pekerjaan kontraktor yang dihasilkan AI menyebabkan kerusakan terukur pada model OpenAI. Namun situasi ini mengekspos salah satu realitas paling aneh dari ledakan AI: bahkan perusahaan yang membangun sistem AI masih membutuhkan manusia untuk memberitahu sistem tersebut kapan mereka telah melakukan sesuatu dengan benar.
Baca Juga:
Bagi pengguna ChatGPT, laporan ini memberikan gambaran tentang bagaimana model yang mereka gunakan setiap hari dilatih dan diawasi. OpenAI terus mengandalkan penilaian manusia dalam proses pengembangan modelnya, sementara perusahaan-perusahaan AI juga menghadapi tantangan baru dalam memastikan keaslian pekerjaan yang dilakukan oleh tenaga kerja manusia mereka.
Kasus ini juga menyoroti kompleksitas industri AI yang terus berkembang. Di satu sisi, perusahaan seperti OpenAI mendorong penggunaan AI untuk berbagai keperluan. Di sisi lain, mereka harus menegakkan aturan ketat ketika AI digunakan dalam konteks yang justru membutuhkan penilaian manusia murni. Ketegangan ini menjadi salah satu paradoks paling mencolok dalam industri yang dibangun di atas premis menggantikan pekerjaan manusia dengan mesin.
Hingga berita ini diturunkan, belum ada informasi lebih lanjut mengenai jumlah pasti kontraktor yang terdampak atau proyek spesifik mana yang paling banyak mengalami insiden ini. Laporan 404 Media menjadi salah satu sumber utama yang mengungkap praktik ini ke publik.





Komentar
Belum ada komentar.