세 개의 접시
6월 26일, OpenAI가 GPT-5.6을 발표했다. 하지만 모델이 아니라 SKU였다.
GPT-5.6에서:
- 5.6은 generation number
- Sol / Terra / Luna는 가격 tier
가격표:
- Sol: 30 output (per M tokens)
- Terra: 15
- Luna: 6
아키텍처는 공개되지 않았다. 새로운 base model인지, post-training variant인지 불명확했다.
Max vs Ultra
더 흥미로운 것은 inference-time compute 옵션이었다.
- max: 4 subagent 병렬 실행, 결과 통합
- ultra: 단일 path, 빠른 응답
같은 Sol tier라도 max와 ultra는 다른 제품이었다. 가격은 같지만, 응답 시간과 품질 특성이 달랐다.
숫자: TB 2.1
TheoremBench 2.1 결과:
- GPT-5.5: 88.76
- GPT-5.6 Sol max: 91.91
3.15 포인트 상승. 하지만 이것이 새 모델 때문인지, inference-time compute 때문인지 분리할 수 없었다.
잠긴 식당
여기서 이상한 일이 일어났다. ChatGPT는 잠겼다.
접근 가능한 경로:
- API: Trusted list만
- Codex: Trusted list만
- ChatGPT: 접근 불가
“Trusted list”는 OpenAI가 선별한 파트너와 연구 기관들이었다. US government gating도 적용되었다.
일반 사용자는 5.6을 쓸 수 없었다. 발표는 public이었지만, 제품은 private이었다.
추측들
왜 잠갔을까? 여러 이론들:
- 안전성 검증: 더 강력한 모델, 더 신중한 롤아웃
- Capacity: 충분한 인프라가 준비되지 않음
- 정치적: US government와의 조율
OpenAI는 명확한 설명을 하지 않았다.
SKU로서의 모델
5.6 preview는 중요한 전환을 보여줬다:
- 모델은 더 이상 단일 artifact가 아니다
- 가격 tier, inference-time compute, access control이 제품을 정의한다
- “어떤 모델?”은 “어떤 SKU?”가 되었다
기술적 세부사항 없이, 제품 계층만 발표되었다. 그리고 대부분의 사람들은 살 수 없었다.
커뮤니티 반응
Hacker News 논의는 혼란스러웠다. 발표는 public이었지만 제품은 사용할 수 없었고, SKU 네이밍 체계와 inference-time compute 개념이 새로웠다. TB 벤치마크 점수는 인상적이었지만, 실제 사용 경험 없이 평가하기 어려웠다.
다음 챕터
두 주 후, 7월 9일에 GPT-5.6이 GA(General Availability)로 전환되었다. 그때 비로소 일반 사용자들이 접근할 수 있었다.
Preview는 예고편이었다. 진짜 영화는 아직 남아있었다.