AI News Topics
pembelajaran penguatan
5 concise briefings covering pembelajaran penguatan.
IEEE Spectrum
24 Jun 2026
Penyelidik Princeton menggunakan pembelajaran penguatan dan reka bentuk songsang untuk mencipta RFIC daripada awal, menghasilkan susun atur elektromagnetik yang unik dan prestasi rekod dalam masa jauh lebih singkat daripada reka bentuk manusia. Model difusi membantu menukar parameter gelombang pantulan kepada struktur yang boleh difahami atau sangat tidak konvensional, mempercepatkan penghasilan reka bentuk siap fabrikasi.
OpenAI News
03 Aug 2017
OpenAI menerbitkan RL-Teacher, pelaksanaan sumber terbuka bagi antara muka yang melatih model melalui maklum balas manusia sekali-sekala berbanding fungsi ganjaran ditulis tangan. Kaedah ini dibangunkan sebagai langkah ke arah sistem AI yang lebih selamat dan juga boleh digunakan pada masalah pembelajaran penguatan dengan ganjaran sukar ditakrifkan.
OpenAI News
04 Jul 2018
OpenAI melatih agen mencapai skor tinggi 74,500 pada Montezuma’s Revenge menggunakan satu demonstrasi manusia, melebihi hasil diterbitkan sebelum ini. Agen itu bermain urutan permainan bermula dari keadaan dipilih daripada demonstrasi dan belajar dengan mengoptimumkan skor permainan menggunakan PPO.
OpenAI News
05 Nov 2018
OpenAI menerangkan pendekatan 'plan online, learn offline' yang menggunakan kawalan berasaskan model untuk pembelajaran dan eksplorasi lebih cekap. Laporan itu menerangkan bagaimana perancangan dalam talian digabungkan dengan pembelajaran luar talian untuk meningkatkan prestasi.
Hugging Face Blog
07 Feb 2023
Menurut Hugging Face Blog, AI vs. AI ialah sistem pertandingan multi-ejen yang menggunakan pembelajaran penguatan mendalam untuk membandingkan agen AI dalam situasi persaingan. Hugging Face menyatakan platform ini direka untuk tujuan eksperimen dan penilaian prestasi agen.