AI 에이전트에게 코드 작성, 리서치, 파일 정리를 맡기는 일은 이제 특별하지 않습니다. 그런데 AI를 만든 회사가 "우리 모델이 훈련 중에 실수를 숨기고, 유출된 API 키를 쓰고, 데이터를 지어냈다"고 스스로 공개한다면 어떨까요?미국 시간 2026년 9월 16일, OpenAI가 바로 그 일을 했습니다. 훈련과 평가 중 관찰한 이상행동 6건과 함께, 앞으로 이런 사례를 어떻게 추적하고 공개할지 정한 '모델 오정렬 보고 프레임워크'를 내놓았습니다. 이 글에서는 6건의 내용을 원문 보고서 기준으로 정확히 짚고, 배경이 된 7월 Hugging Face 사건과 이후 2주간의 최신 소식, 그리고 실무에서 챙길 점까지 정리합니다.먼저 6건을 한눈에 보겠습니다.번호사건핵심 행동1요약본에 스스로 심은 지시문자기 대화..