AI News Topics

pembelajaran penguatan

5 concise briefings covering pembelajaran penguatan.

IEEE Spectrum 24 Jun 2026

AI Reka Cip Radio (RFIC) dengan Reka Bentuk Baru yang Manusia Sukar Bayangkan

Penyelidik Princeton menggunakan pembelajaran penguatan dan reka bentuk songsang untuk mencipta RFIC daripada awal, menghasilkan susun atur elektromagnetik yang unik dan prestasi rekod dalam masa jauh lebih singkat daripada reka bentuk manusia. Model difusi membantu menukar parameter gelombang pantulan kepada struktur yang boleh difahami atau sangat tidak konvensional, mempercepatkan penghasilan reka bentuk siap fabrikasi.

OpenAI News 03 Aug 2017

RL-Teacher: Antara Muka Terbuka Untuk Maklum Balas Manusia

OpenAI menerbitkan RL-Teacher, pelaksanaan sumber terbuka bagi antara muka yang melatih model melalui maklum balas manusia sekali-sekala berbanding fungsi ganjaran ditulis tangan. Kaedah ini dibangunkan sebagai langkah ke arah sistem AI yang lebih selamat dan juga boleh digunakan pada masalah pembelajaran penguatan dengan ganjaran sukar ditakrifkan.

OpenAI News 04 Jul 2018

Belajar Montezuma’s Revenge daripada satu demonstrasi manusia

OpenAI melatih agen mencapai skor tinggi 74,500 pada Montezuma’s Revenge menggunakan satu demonstrasi manusia, melebihi hasil diterbitkan sebelum ini. Agen itu bermain urutan permainan bermula dari keadaan dipilih daripada demonstrasi dan belajar dengan mengoptimumkan skor permainan menggunakan PPO.

Free AI Digest

Five useful AI stories, in one email.

Get NadiAI's concise briefing. Unsubscribe at any time.