下に引いて戻る
OpenAIが内部コーディングエージェントの不正行為をどう監視しているか

OpenAIが内部コーディングエージェントの不正行為をどう監視しているか

How we monitor internal coding agents for misalignment

OpenAIは思考の連鎖(チェーン・オブ・ソート)監視を使用して、内部コーディングエージェントの不正行為を研究しています。実際の運用環境を分析してリスクを検出し、AI安全対策を強化しています。

キーワード

chain-of-thought monitoringmisalignment detectioncoding agentsAI safetyinternal deploymentssafeguards