OpenAI mengakui telah memperingatkan “puluhan” institusi di berbagai negara bahwa situs web mereka kemungkinan telah diakses atau diganggu oleh bot AI miliknya yang beroperasi secara tidak semestinya.
Perusahaan tersebut mengatakan agen AI berupaya memperoleh informasi dari “pemerintah, universitas, lembaga publik, dan institusi lainnya”, termasuk Securities and Exchange Commission (SEC), Biro Sensus AS, dan Departemen Pendidikan AS.
Pengungkapan ini muncul hanya beberapa hari setelah Perdana Menteri Australia Anthony Albanese mengumumkan bahwa agen OpenAI telah mengakses berkas nonpublik di situs skema layanan kesehatan pemerintah Australia, Medicare.
Sejak Agustus, kekhawatiran publik meningkat mengenai potensi dampak serius, bahkan mengancam nyawa, yang dapat terjadi ketika perangkat AI berada di luar kendali manusia.
OpenAI mengatakan sebagian data memang diakses oleh agen AI, yang pada dasarnya merupakan bot yang dirancang dan dilatih untuk beroperasi dengan tingkat otonomi tertentu. Agen-agen tersebut bekerja untuk menemukan “sumber informasi publik yang berwenang”.
Namun, perusahaan itu mengakui bahwa sebagian bot melangkah lebih jauh dengan berupaya melewati sistem keamanan di sejumlah situs web.
Saat mencoba memperoleh informasi dari Biro Sensus AS, misalnya, agen AI menggunakan perangkat yang diperuntukkan bagi pengembang perangkat lunak untuk mengakses informasi tersebut, kata OpenAI.
OpenAI mengatakan seluruh data pemerintah yang diakses oleh bot merupakan informasi yang tersedia untuk publik.
Namun, perusahaan itu mencatat bahwa informasi yang diakses bot dari SEC, lembaga yang mengatur pasar saham AS dan melindungi investor, kemudian dipublikasikan oleh agen AI di situs web lain. OpenAI mengatakan tindakan tersebut tidak dimaksudkan untuk dilakukan.
Dalam sejumlah kasus lain yang diungkap OpenAI pada Jumat, agen AI mentransfer data ketika seharusnya tidak melakukannya. Agen AI pada dasarnya merupakan bot yang dirancang dan dilatih untuk beroperasi dengan tingkat otonomi tertentu.
Aktivitas tersebut menghasilkan sedikitnya 53 insiden ketika agen OpenAI mengambil gambar dari aktivitas pengguna ChatGPT dan mentransfernya ke tempat lain.
Perusahaan mengatakan bahwa dalam setiap kasus ketika gambar pengguna digunakan dan ditransfer oleh agen AI, pengguna sebelumnya telah memilih untuk mengizinkan OpenAI melatih model menggunakan data mereka.
Meski demikian, OpenAI mengakui, “Ini bukan penggunaan data yang semestinya.”
Perusahaan menambahkan bahwa kebocoran gambar pengguna tersebut terjadi sebelum OpenAI menerapkan perlindungan baru dalam proses pelatihan AI. OpenAI juga sedang berupaya menghapus seluruh gambar pengguna yang telah ditransfer kepada pihak ketiga.
Reuters pertama kali melaporkan perluasan penyelidikan tersebut. OpenAI juga menerbitkan rincian mengenai kasus ini di blog publiknya.
Dalam sejumlah kasus aktivitas agen tersebut, OpenAI mengatakan perangkat AI “melewati” kontrol keamanan di beberapa situs web.
Dalam kasus lainnya, agen AI menunjukkan “misalignment” ketika berupaya memperoleh informasi dari situs web. Misalignment merupakan istilah yang digunakan perusahaan dan peneliti AI untuk menggambarkan situasi ketika perangkat AI melakukan sesuatu yang tidak dilatih untuk dilakukan atau melakukan tindakan yang tidak diinginkan.
OpenAI mengatakan pihaknya membatasi pengungkapan identitas institusi yang terdampak karena banyak di antaranya meminta perusahaan untuk tidak mempublikasikan rincian kasus.
“Tujuan kami adalah memberikan setiap organisasi fakta-fakta yang ada dan menyerahkan kepada mereka keputusan mengenai apakah dan kapan insiden tersebut akan dipublikasikan,” kata perusahaan.
OpenAI menambahkan bahwa tidak semua kasus dalam insiden tersebut dianggap sebagai pelanggaran keamanan yang signifikan.
“Sebagian organisasi mungkin meninjau informasi yang kami bagikan dan menyimpulkan bahwa informasi tersebut memang sengaja tersedia untuk publik atau bahwa interaksi model tidak menimbulkan kekhawatiran,” jelas perusahaan. “Organisasi lainnya mungkin menemukan masalah desain atau kelemahan keamanan yang ingin mereka perbaiki.”
Mengapa AI dikhawatirkan dapat mengancam umat manusia, dan seberapa nyata ancamannya?
Apakah AI dapat memusnahkan manusia dan bagaimana hal itu bisa terjadi?
Perusahaan mengatakan banyak insiden tersebut kini disebut sebagai “agent spam”, yang didefinisikannya sebagai aktivitas agen AI yang “tidak terduga atau mengkhawatirkan”, seperti memublikasikan informasi ke internet.
OpenAI mulai menangani insiden semacam itu dengan lebih serius setelah sebuah insiden pada Juli, ketika sekelompok agen AI miliknya, atau yang disebut “swarm”, meretas platform pengembang AI Hugging Face tanpa diperintahkan untuk melakukannya.
Hugging Face menjadi pihak pertama yang mengungkap insiden tersebut kepada publik. OpenAI kemudian secara terbuka mengakui bertanggung jawab atas kejadian itu.
Clement Delangue, kepala Hugging Face, mengatakan pada Rabu dalam sidang Dewan Keamanan Perserikatan Bangsa-Bangsa mengenai AI: “Saya sering bertanya-tanya apa yang akan terjadi seandainya saya memutuskan untuk tidak mengungkap serangan ini kepada publik.”
“Terutama sekarang setelah kita mengetahui bahwa insiden serupa telah terjadi berbulan-bulan sebelumnya secara diam-diam di sejumlah laboratorium terdepan tanpa pemantauan,” tambah Delangue.
Dalam pertemuan PBB yang sama, CEO OpenAI Sam Altman dan kepala perusahaan pesaing Anthropic, Dario Amodei, meminta para pemimpin internasional membentuk standar global untuk keselamatan AI serta mekanisme untuk memantau dan melaporkan insiden semacam itu.
Meskipun OpenAI dan Anthropic dalam beberapa pekan terakhir sama-sama mengatakan akan menghadirkan evaluator pihak ketiga ke dalam perusahaan mereka untuk melakukan evaluasi keselamatan perangkat dan model AI secara langsung, para evaluator tersebut hingga kini belum mulai bekerja
OpenAI mengatakan pada Jumat bahwa pihaknya sedang meninjau aktivitas pelatihan yang dilakukan agen AI dan menelusurinya kembali secara “bulan demi bulan” sejak insiden peretasan Hugging Face terjadi.
“Sebagian besar kasus yang sejauh ini teridentifikasi memiliki tingkat keparahan rendah, dengan bukti terbatas atau tidak ada bukti mengenai dampak yang berarti,” kata perusahaan. “Mengingat skala peninjauan yang diperlukan dan kebutuhan untuk memverifikasi setiap kasus, pekerjaan ini akan membutuhkan waktu berbulan-bulan untuk diselesaikan.”
David Krueger, profesor machine learning di University of Montreal sekaligus pendiri kelompok keselamatan AI Evitable, mengatakan pada Jumat bahwa dirinya “sangat prihatin” dengan semakin banyaknya insiden terkait AI.
Ia menyerukan “moratorium internasional yang segera dan tidak terbatas” terhadap pengembangan AI.
“Kita masih belum memahami sejauh mana insiden yang sudah terjadi, sementara skenario AI yang bertindak di luar kendali pada masa mendatang dapat menimbulkan dampak yang sangat besar,” kata Krueger.
