아래로 당겨서 돌아가기
OpenAI가 내부 코딩 에이전트의 오작동을 감시하는 방법

OpenAI가 내부 코딩 에이전트의 오작동을 감시하는 방법

How we monitor internal coding agents for misalignment

OpenAI는 사고 연쇄(Chain-of-Thought) 모니터링을 사용하여 내부 코딩 에이전트의 오작동을 연구합니다. 실제 배포 환경을 분석하여 위험을 감지하고 AI 안전 장치를 강화하고 있습니다.

키워드

chain-of-thought monitoringmisalignment detectioncoding agentsAI safetyinternal deploymentssafeguards