Pull down to go back
How we monitor internal coding agents for misalignment

How we monitor internal coding agents for misalignment

OpenAI 如何監控內部編碼代理的不當行為

How OpenAI uses chain-of-thought monitoring to study misalignment in internal coding agents—analyzing real-world deployments to detect risks and strengthen AI safeguards.

Keywords

chain-of-thought monitoringmisalignment detectioncoding agentsAI safetyinternal deploymentssafeguards