2本の記事で説明した語です。文脈ごとに言い方が変わるので、記事ごとにそのまま並べます。
AIの振る舞いを人間の価値観に沿わせ、人間の制御下に保つための研究領域。
AIがAIを改良し始める前に OpenAIが安全基準づくりを米国に求める2026年9月22日
AIを意図どおりに動かし、人間の監督に応じる状態に保つための研究領域
30分で誤検知と言い切れなければ止める OpenAIが訓練を2週間止めた基準2026年8月19日
用語集へ戻る