Memperbaiki Tingkah Laku Keselamatan Model dengan Ganjaran Berasaskan Peraturan
OpenAI membangunkan dan mengaplikasikan kaedah baru menggunakan Ganjaran Berasaskan Peraturan (RBR) untuk melaras tingkah laku model agar lebih selamat. Kaedah ini dikatakan mengurangkan keperluan pengumpulan data manusia yang meluas.