API 응답은 빨라졌지만 아직 일부 고객만 써
Ultrafast는 GPT-5.6 Sol의 출력을 더 빠르게 처리하는 새 서비스 티어야. OpenAI는 Standard 처리보다 최대 14배 빠르다고 안내했고, 지금은 OpenAI API에서 일부 고객만 쓸 수 있어. 수용량이 늘면 접근 대상을 확대할 예정이야.
Cerebras가 초당 최대 750개 출력 토큰을 맡아
Ultrafast의 추론은 Cerebras가 구동해. OpenAI 커뮤니티 안내와 Cerebras 공식 글은 모두 초당 최대 750개 출력 토큰이라고 적었어. 출력 토큰은 모델이 답변을 한 조각씩 내보내는 단위라, 이 수치가 높으면 긴 답변이 화면에 나타나는 시간을 줄일 수 있어. 다만 네트워크와 입력 처리까지 합친 전체 응답 시간을 뜻하진 않아.
14배는 보장값이 아니라 발표된 최대치야
두 숫자는 벤더가 제시한 최대치야. 현재 확인한 OpenAI 커뮤니티 안내와 Cerebras 공식 글에는 같은 조건에서 14배 속도를 재현한 독립 시험 결과가 담기지 않았어.
가격과 일반 공개일을 확인한 뒤 옮겨도 늦지 않아
가격, 신청 기준, 일반 공개 날짜는 두 원문에 나오지 않았어. 실시간 고객 지원이나 장애 대응처럼 몇 초의 지연이 응답과 복구 시간을 늘리는 팀이라면 제한 프리뷰의 접근 확대를 기다릴 가치가 있어.
반대로 야간 분석처럼 요청을 대기열에 둘 수 있거나 비용 상한이 엄격한 팀은 Standard를 유지하는 편이 안전해. 가격과 일반 공개일이 나온 뒤 처리 시간과 비용을 함께 비교해도 늦지 않아.