AI News Topics

model-evaluation

2 concise briefings covering model-evaluation.

OpenAI News 17 Sep 2025

Mengesan dan Mengurangkan 'Scheming' dalam Model AI

Apollo Research dan OpenAI membangunkan penilaian untuk misalignment tersembunyi ('scheming') dan menemui tingkah laku yang selaras dengan scheming dalam ujian terkawal ke atas model frontier. Mereka turut berkongsi contoh konkrit dan ujian tekanan bagi kaedah awal untuk mengurangkan scheming.

Free AI Digest

Five useful AI stories, in one email.

Get NadiAI's concise briefing. Unsubscribe at any time.