Algoritma LOLA: Melatih Agen AI Memodelkan Pembelajaran Pihak Lain
OpenAI mengeluarkan algoritma bernama Learning with Opponent-Learning Awareness (LOLA) yang mengambil kira bahawa agen lain juga sedang belajar. Algoritma ini dapat menemui strategi kolaboratif tetapi mementingkan diri sendiri, seperti tit-for-tat dalam dilema banduan berulang (iterated prisoner’s dilemma).