3일 예보가 기존 2일 예보만큼 맞았어

“사이클론 3일 예보가 기존 운영 모델의 2일 예보만큼 정확해졌어.”

8월 6일 네이처에 실린 구글 딥마인드의 WeatherNext 결과가 그거야. 같은 시점끼리 비교하면 24시간 넘는 리드타임 우위가 생겨.

비교 대상은 항목별로 달라. 이동 경로는 유럽중기예보센터의 ECMWF-ENS, 강도는 미국 허리케인 예보 모델 HWRF를 놓고 쟀어. 평가에 쓴 사이클론은 2023~2024년에 발생한 것들이고, 3일 정확도 비교는 2025년까지 이어졌어.

구글 뉴스룸은 이걸 “약 10년치 기상학 진보”라고 적었어. 그건 구글 쪽 표현이고, 확인 가능한 숫자는 위의 리드타임 비교까지야.

앙상블을 50개에서 1,000개로 늘렸어

  • 학습 데이터: 전 지구 대기 데이터 약 20TB, 여기에 과거 폭풍 약 5,000건이 담긴 IBTrACS 데이터셋을 더했어
  • 앙상블: 2025년 허리케인 시즌엔 한 사이클론에 50개를 돌렸는데, 지금은 1,000개 시나리오까지 뽑아
  • 해상도: WeatherNext 2와 Cyclones는 0.25도 격자, 대략 28km야. mini 변형은 1도라 111km 정도고

시나리오를 1,000개 돌리는 이유는 하나의 경로를 찍기 위해서가 아니야. 폭풍급에서 허리케인급 바람이 어디에 얼마나 걸릴지를 확률 지도로 만들려는 거야. 그래서 앙상블 개수가 20배 늘어난 게 정확도 숫자보다 실무에선 더 크게 느껴질 수 있어.

코드는 Apache 2.0인데 가중치는 버킷에서 따로 받아

저장소를 열어보면 라이선스가 한 종류가 아니야. 노트북과 코드는 Apache 2.0이고, 그 밖의 자료는 CC BY 4.0이야. 오픈 웨이트라고 뭉뚱그리기 전에 이 구분을 봐야 해.

가중치 자체는 저장소에 안 들어 있어. dm_graphcast 구글 클라우드 버킷에서 따로 받는 구조야. 변형은 세 갈래로 나왔어 — WeatherNext 2, WeatherNext Cyclones, 그리고 가벼운 Cyclones Mini야.

Cyclones는 학습 연도 기준으로 2023년 미만, 2024년 미만, 2025년 미만 체크포인트가 갈라져 있어. 평가하려는 폭풍이 학습에 섞이지 않게 끊어 놓은 구성이라, 자기 데이터로 벤치마크를 다시 돌릴 때 어느 체크포인트를 집을지가 결과를 가른다는 뜻이기도 해.

갖다 쓰기 전에 확인할 것

  • 면책 문구: 저장소는 “공식 지원되는 구글 제품이 아니”라고 적고, 어떤 정부 기상 기관과도 협력하거나 승인받지 않았으며 그런 기관의 공식 경보를 “어떤 식으로도 대체하지 않는다”고 명시해.
  • 협력과 배포물은 다른 층: 발표문엔 미국 국립허리케인센터(NHC), CIRA, 영국 기상청과 협력했다고 적혀 있어. 그건 연구·평가 단계 이야기고, 위 면책은 공개된 산출물에 붙는 조건이야. 두 개를 합쳐서 “기상청 승인 모델”로 읽으면 안 돼.
  • 수치의 출처: 리드타임과 정확도 비교는 전부 구글이 직접 낸 평가야. 제3자가 같은 벤치마크를 재현한 기록은 아직 안 보여.
  • 다음 질문: 이걸 파이프라인에 넣을 거면 성능 폭보다 먼저 결정할 게 있어. 산출물을 참고 지표로만 쓸지, 아니면 경보성 알림에 태울지야. 후자면 면책 문구가 그대로 쓰는 쪽 책임으로 넘어와.