Belajar daripada pilihan manusia untuk keselamatan AI
OpenAI bersama pasukan keselamatan DeepMind membangunkan algoritma yang menilai keutamaan manusia dengan membandingkan dua tingkah laku dan menentukan yang lebih baik. Langkah ini bertujuan mengurangkan keperluan fungsi tujuan bertulis manusia yang boleh salah wakil dan menyebabkan tingkah laku berbahaya.