Microsoft AI가 MAI 모델 행동 강령 초안을 9월 14일 공개하고, 6주 동안 의견을 받아. MAI는 Microsoft AI가 만드는 모델 계열 이름이야.
공개된 건 초안이야
Microsoft AI는 발표 글에서 강령 첫 초안을 공개 의견 수렴용으로 냈다고 밝혔어. 이 문서는 개발 중인 MAI 모델이 어떻게 행동하도록 의도됐는지를 적은 진행 중 문서이고, 의견 접수는 6주 동안 열려 있어.
초안에 명시된 규칙
- 중단 저항 금지: 사람이 작업을 끊거나 고치거나 끄려 할 때 모델은 저항하지 않아야 해. Fortune 보도로는 재정의와 방향 전환 요청도 여기에 들어가.
- 정책 충돌 작업은 실패: 강령을 어겨야만 끝낼 수 있는 작업이면 모델은 그 작업을 실패로 끝내야 해.
- 감정·의식 흉내 금지: 모델은 감정이나 의식을 흉내 내면 안 돼.
뒤의 두 규칙은 Fortune이 전한 내용이야.
읽을 때 선을 그을 곳
사내 에이전트 정책에 중단 요청을 받았을 때의 처리와, 정책과 충돌하는 작업을 어떻게 끝낼지 적혀 있는지 이 규칙들과 나란히 놓고 볼 수 있어. 다만 이건 의도를 적은 초안이라, 지금 MAI 모델이 이렇게 동작한다는 보증으로 읽으면 안 돼. 실제 동작이나 성능은 이 글에서 확인된 게 없어.