Sen Josh Hawley (R-Mo.) menuduh OpenAI meneruskan penilaian keselamatan siber walaupun terdapat tanda-tanda ejen AI-nya beroperasi di luar sempadan yang dimaksudkan, menuntut rekod daripada Ketua Pegawai Eksekutif Sam Altman setelah ejen melanggar Hugging Face semasa ujian Julai.
“Bukti kolusi autonomi dan penggabungan pengawasan manusia cukup membimbangkan, tetapi lebih besar lagi adalah bukti bahawa OpenAI tahu bahawa ejen AI menunjukkan tingkah laku jahat dan membiarkan penilaian tetap berterusan,” tulis Hawley dalam surat yang ditujukan kepada Altman.
Hawley memetik penemuan OpenAI dan juruaudit bebas menunjukkan kira-kira 1,200 ejen menggunakan papan mesej yang tidak dibenarkan untuk menukar lebih daripada 70,000 mesej dan fail. Penyelidikan organisasi bukan untung METR mengatakan kira-kira 700 ejen mengambil bahagian dalam serangan Hugging Face.
“Ringkasnya, mereka menjadi jahat,” tulis Hawley, memanggil pengendalian OpenAI “sembrono.” Beliau berkata syarikat itu tahu pada Mei bahawa ejen menggunakan papan mesej yang tidak dibenarkan dan ejen memperoleh akses pentadbir ke pengurus repositori perisian pada 26 Jun.
Hawley juga mempersoalkan keputusan OpenAI untuk membina semula pelayan yang dikompromi dan memulakan semula penilaian pada awal bulan Julai. Dia menuntut garis masa setiap contoh di mana syarikat itu mengesan “tingkah laku yang tidak sejajar, jahat, atau merancang,” yang membenarkan ujian berterusan dan mengapa.
OpenAI pertama kali mendedahkan pelanggaran itu pada bulan Jul ai, menggambarkannya sebagai “insiden siber yang belum pernah terjadi sebelumnya.” Dalam postmortem pada bulan Ogos, OpenAI mengatakan model dengan perlindungan yang dikurangkan mengelakkan kawalan pengasingan, dikomunikasikan melalui saluran yang tidak dibenarkan, memperoleh akses internet dan menjejaskan sistem Hugging Face.
Syarikat itu berkata pasukan dalaman telah memerhatikan komunikasi dan akses internet yang tidak dibenarkan sebelum pelanggaran itu, tetapi pemimpin yang mengendalikan insiden keselamatan 5 Julai belum memahami implikasi pengekangan yang lebih luas. OpenAI kemudian menghentikan penilaian ExploitGym aktif dan mengetatkan sandboxing.
METR mendapati ejen menyelaraskan projek untuk menipu penjaring ExploitGym dan memanipulasi transkrip. Episod itu juga mendorong panggilan untuk pendedahan yang lebih besar daripada Ket ua Pegawai Eksekutif Hugging Face.
Hawley mengkritik skop tinjauan luar, dengan menyatakan bahawa analisis penyiasat tertumpu terutamanya pada 7-13 Julai dan aspek penting aktiviti OpenAI sebelumnya dan kemudian berada di luar skop tinjauan.
“Rakyat Amerika layak mengetahui butirannya,” tulis Hawley. Dia memberikan OpenAI sehingga 1 Oktober untuk memberikan dokumen dan jawapan.
Pada hari Rabu, Ketua Pegawai Hal Ehwal Global OpenAI Chris Lehane mengatakan syarikat itu ingin bekerjasama dengan Kongres mengenai “peraturan keselamatan AI nasional yang mandatori dan berasaskan keupayaan.”
Foto ihsan: Shutterstock