Bagaimana OpenAI Memantau Agen Pengkodan Dalaman untuk Misalignment
OpenAI menerangkan penggunaan pemantauan rantaian pemikiran (chain-of-thought monitoring) untuk mengkaji misalignment dalam agen pengkodan dalaman. Mereka menganalisis penyebaran dunia sebenar bagi mengesan risiko dan memperkukuh langkah keselamatan AI.