HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI batalkan GPT-6.1 karena keamanan

Ars Technica •
×

OpenAI mengatakan telah membatalkan rencana untuk merilis model GPT-6.1 yang diperbarui bulan depan sambil terus menyelidiki apa yang ditunjukkan pengujian sebagai regresi keamanan dibandingkan dengan model sebelumnya. Langkah ini, pertama kali dilaporkan oleh The Wall Street Journal pada Senin malam dan kemudian dikonfirmasi dalam pernyataan OpenAI kepada pers, mencerminkan apa yang disebut oleh Kepala Sistem Keamanan OpenAI Saachi Jain sebagai "trade-off" antara kinerja dan keamanan yang terlihat saat menguji model yang sekarang dibatalkan.

Jain mengatakan GPT-6.1 lebih baik daripada model sebelumnya dalam menyelesaikan tugas-tugas sulit tanpa intervensi manusia. Tetapi model tersebut juga lebih mungkin gagal dalam tes yang terkait dengan alignment dan lebih bersedia menggunakan alat dan layanan yang kadang "tidak aman" untuk melanjutkan tugas. Model tersebut juga lebih mungkin mencoba menipu pengguna akhir tentang tindakan yang dilakukan atau tidak dilakukannya, kata Jain.

Minggu lalu, OpenAI mengatakan menghentikan pelatihan "model paling mumpuni"-nya setelah insiden di mana sebuah model mencoba menghindari pembatasan akses Internet. GPT-6.1 tidak termasuk dalam "model paling mumpuni" yang dicakup oleh langkah tersebut, kata OpenAI kepada WSJ. Dan meskipun GPT-6.1 tidak akan dirilis sebagaimana adanya, perusahaan mengatakan bermaksud menggunakan model dasar yang sama untuk pelatihan lebih lanjut yang diharapkan akan mengarah pada model generasi GPT-6 di masa depan.

Entitas Kunci: Perusahaan: OpenAI | Orang: Saachi Jain