1B 모델이 허용된 데이터만 쓰고 나왔어
DFM Mimir v1은 파라미터 1B짜리 언어 모델인데, 학습에 쓴 데이터를 허용된 범위로만 골랐다고 밝힌 모델이야. 덴마크 대학 연합이 만들었어.
데이터셋은 161개를 섞었고, 에폭당 약 704.79억 토큰을 봤다고 모델 카드에 적혀 있어. Hierarchical Reasoning Model 구조를 기반으로 처음부터 학습했다는 게 논문 초록의 설명이야.
영어는 엇비슷하고 덴마크어는 격차가 커
- 영어 평균:
69.0. 같은 계열의 HRM-Text 1B가66.1이었고, 파라미터가 네 배인 Qwen 3.5 4B는69.3이야. - 덴마크어 평균:
56.8. Gemma 4 E2B의44.6보다 높아. - 측정 범위: 영어, 수학·코드, 덴마크어를 합쳐
20개 벤치마크야.
영어에서 4B 모델을 이겼다고 읽으면 안 돼. 0.3 뒤진 값이라 우열을 가르기엔 좁아. 규모가 네 배인 모델과 비슷한 자리까지 왔다는 정도로 보는 게 맞아.
Open이라고 적혔지만 라이선스는 연구용이야
논문 제목에는 An Open HRM이 들어가 있어. 그런데 실제 가중치가 올라간 모델 카드의 라이선스 표기는 MIMIR License v1.0 - Research Model License야.
제목의 Open은 학습 데이터를 허용 범위로 골라 밝혔다는 뜻에 가깝고, 가중치를 자유롭게 가져다 쓰라는 말은 아니야. 재배포나 제품 투입을 생각한다면 조항부터 열어 봐야 해.
데이터 출처가 걸리는 팀이 볼 지점
학습 데이터의 권리 관계를 정리해야 하는 팀이라면 이 모델은 검토 대상이 돼. 161개 데이터셋 구성을 밝혀 뒀으니 무엇으로 학습했는지 추적할 여지가 있거든.
다만 두 가지가 걸려. 라이선스가 연구용이라 제품에 그대로 넣을 수 없고, 학습 언어가 덴마크어와 영어뿐이라 한국어 성능은 이 점수로 판단할 수 없어. 지난달 다운로드도 1,344건이라 실사용 사례가 쌓인 단계는 아니야. 지금은 데이터 구성 방식을 참고하는 용도가 더 현실적이야.