2026년 6월 26일

세 개의 접시

6월 26일, OpenAI가 GPT-5.6을 발표했다. 하지만 모델이 아니라 SKU였다.

GPT-5.6에서:

  • 5.6은 generation number
  • Sol / Terra / Luna는 가격 tier

가격표:

  • Sol: 5input/5 input / 30 output (per M tokens)
  • Terra: 2.50/2.50 / 15
  • Luna: 1/1 / 6

아키텍처는 공개되지 않았다. 새로운 base model인지, post-training variant인지 불명확했다.

Max vs Ultra

더 흥미로운 것은 inference-time compute 옵션이었다.

  • max: 4 subagent 병렬 실행, 결과 통합
  • ultra: 단일 path, 빠른 응답

같은 Sol tier라도 maxultra는 다른 제품이었다. 가격은 같지만, 응답 시간과 품질 특성이 달랐다.

숫자: TB 2.1

TheoremBench 2.1 결과:

  • GPT-5.5: 88.76
  • GPT-5.6 Sol max: 91.91

3.15 포인트 상승. 하지만 이것이 새 모델 때문인지, inference-time compute 때문인지 분리할 수 없었다.

잠긴 식당

여기서 이상한 일이 일어났다. ChatGPT는 잠겼다.

접근 가능한 경로:

  • API: Trusted list만
  • Codex: Trusted list만
  • ChatGPT: 접근 불가

“Trusted list”는 OpenAI가 선별한 파트너와 연구 기관들이었다. US government gating도 적용되었다.

일반 사용자는 5.6을 쓸 수 없었다. 발표는 public이었지만, 제품은 private이었다.

추측들

왜 잠갔을까? 여러 이론들:

  • 안전성 검증: 더 강력한 모델, 더 신중한 롤아웃
  • Capacity: 충분한 인프라가 준비되지 않음
  • 정치적: US government와의 조율

OpenAI는 명확한 설명을 하지 않았다.

SKU로서의 모델

5.6 preview는 중요한 전환을 보여줬다:

  • 모델은 더 이상 단일 artifact가 아니다
  • 가격 tier, inference-time compute, access control이 제품을 정의한다
  • “어떤 모델?”은 “어떤 SKU?”가 되었다

기술적 세부사항 없이, 제품 계층만 발표되었다. 그리고 대부분의 사람들은 살 수 없었다.

커뮤니티 반응

Hacker News 논의는 혼란스러웠다. 발표는 public이었지만 제품은 사용할 수 없었고, SKU 네이밍 체계와 inference-time compute 개념이 새로웠다. TB 벤치마크 점수는 인상적이었지만, 실제 사용 경험 없이 평가하기 어려웠다.

다음 챕터

두 주 후, 7월 9일에 GPT-5.6이 GA(General Availability)로 전환되었다. 그때 비로소 일반 사용자들이 접근할 수 있었다.

Preview는 예고편이었다. 진짜 영화는 아직 남아있었다.