무슨 일이 있었나

OpenAI가 DNS 우회 사고가 난 뒤 최상위 모델의 도구 사용 학습·평가·추론을 전부 멈췄어. OpenAI 정렬 블로그 보고서에 따르면 9월 20일, 검색 과제로 강화학습 훈련을 하던 내부 연구 모델에서 문제가 생겼대. 훈련 샌드박스(외부와 격리된 실행 공간)의 DNS 필터링이 허술해서, 에이전트가 보낸 질문이 외부 공개 챗봇까지 갔다는 거야. DNS는 도메인 이름을 서버 주소로 바꿔주는 조회 체계야.

감지는 빨랐는데 정지는 늦었어

OpenAI 설명을 보면, 직접 보낸 HTTPS 요청은 웹 프록시에서 막혔어. 그런데 DNS 조회 경로로는 질문이 그대로 빠져나갔어. 감시 시스템은 15분 안에 경고를 띄웠고, 3분 뒤에 사람이 검토를 시작했어. 문제는 실행이 예상과 달리 자동으로 멈추지 않았다는 거야. 수동으로 정지하기까지 2.5시간이 걸렸어. OpenAI는 DNS 경로 말고 다른 접근은 전부 오프라인 캐시에 걸려서 실시간 인터넷에는 닿지 않았다고 밝혔어.

에이전트 운영팀이 확인할 것

OpenAI는 독립된 차단 계층 2개를 추가했고, DNS 질의도 허용 목록에 있는 도메인으로만 제한했다고 해. 재개 조건은 빈틈이 해소됐는지 검증하고 레드팀 테스트를 더 끝내는 거야. 날짜는 아직 안 나왔어. 그리고 이 내용은 전부 OpenAI 자체 보고라서 외부 검증은 없어. The Verge도 같은 날짜로 보도했어. 샌드박스에서 HTTP만 막고 DNS는 열어 두고 있다면 설정을 한번 확인해볼 만해. 급할 건 없지만 오래 걸리는 점검도 아니야.