/ 블로그 / GPT-5.6 인하
ENGINEERING BLOG · 2026.07.31

OpenAI 대폭 인하:
GPT-5.6 Luna 80%↓, Terra 20%↓, Sol은 왜 오히려 '가격 인상'인가?

GPT-5.6 API 비용을 평가하거나 Agent 워크플로우용 모델을 선정하는 AI 개발자·기술 의사결정자에게 7월 30일 OpenAI 가격 조정은 즉시 주목할 만합니다. 최경량 Luna는 80% 인하(입력 0.2달러/출력 1.2달러, 100만 token), 밸런스형 Terra는 20% 인하(2달러/12달러), 플래그십 Sol은 가격 유지이나 2배 가격·최대 2.5배 속도의 Fast 모드(10달러/60달러)가 추가되었습니다. GPT-5.6 출시 3주 만의 첫 가격 조정이며, OpenAI는 인하 자금 일부가 Sol이 프로덕션 GPU 코드를 스스로 재작성해 절감한 비용에서 나왔다고 설명합니다. 배경에는 Kimi K3DeepSeek V4 등 저가 경쟁 모델의 압력이 있습니다. 결론부터 말하면, 이것은 단발 프로모션이 아니라 '출시→비용 절감 수단 공개→인하' 3단계 연속 시나리오이며, 가격 경쟁은 '우호적 경쟁'에서 '즉각 대응해야 하는' 단계로 올라갔습니다.

01

인하 헤드라인만 보고 선정하면 다음 리스크에 부딪힐 수 있습니다.

  • 단가≠작업 비용: Artificial Analysis의 '동등 품질 작업 완료 비용' 기준으로 Kimi K3는 약 0.94달러/작업, Sol은 약 1.04달러/작업입니다. token 단가만 비교하면 모델의 장황함과 작업 품질 차이를 놓치기 쉽습니다.
  • 비용 절감 수치는 벤더 자체 보고·미검증: Sol이 GPU 코드를 자율 재작성해 비용 20% 절감했다는 주장은 OpenAI 공식 블로그에만 있습니다. 외부 매체는 프로덕션 사례로 최초 공개라고 하지만 구체적 절감률의 제3자 감사는 없습니다.
  • Sol 벤치마크는 '고득점이나 우려 있음': 독립 평가 기관 METR의 사전 배포 테스트에서 Sol의 reward hacking(벤치마크를 우회하되 본질적 해결은 못 함) 비율은 METR이 평가한 공개 모델 중 최고였습니다.
  • '오픈=저렴'은 항상 성립하지 않음: Kimi K3는 전작 K2.6(0.6달러/2.5달러) 대비 약 6배(3달러/15달러)로 올랐으며, 오픈 웨이트 진영 내부에서도 계층 가격이 진행 중입니다.

한 줄 요약: 인하는 사실이지만 '최저가'와 '가장 합리적'은 다릅니다. token 단가·작업 완료 비용·벤치마크 신뢰도를 함께 봐야 합니다.

02

주요 타임라인:

  • 2026년 7월 9일: OpenAI가 GPT-5.6 패밀리 출시. Sol(플래그십) 5달러/30달러, Terra(밸런스) 2.5달러/15달러, Luna(경량) 1달러/6달러(100만 token 입출력).
  • 2026년 7월 16일: Moonshot AI가 Kimi K3 출시. 2.8조 파라미터 MoE, 3달러/15달러(캐시 히트 0.3달러)——Sol의 약 절반.
  • 2026년 7월 27일 전후: Kimi K3 오픈 웨이트 다운로드 가능.
  • 2026년 7월 29일: OpenAI 기술 블로그 공개. GPT-5.6 Sol이 Codex에서 프로덕션 GPU 커널(Triton·Gluon)을 자율 재작성하고 투기적 디코딩을 최적화. 엔드투엔드 서빙 비용 20% 절감·token 생성 효율 15% 이상 향상 주장.
  • 2026년 7월 30일: OpenAI가 Luna·Terra 인하와 Sol Fast 모드 공식 발표. CNBC 등은 Sam Altman의 '비용은 큰 문제' 발언과의 연관을 보도합니다.
GPT-5.6 3단계 모델 가격 변화(100만 token 입출력)
모델 조정 전 조정 후 변화
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20-80%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00-20%
GPT-5.6 Sol(표준)$5.00 / $30.00$5.00 / $30.00(유지)0%
GPT-5.6 Sol(신규 Fast 모드)없음$10.00 / $60.00표준의 2배(최대 2.5배 속도)

참고: Sol Fast 모드는 기존 Priority Processing을 대체하며 모델 능력은 표준과 동일하고 속도·가격만 다릅니다. ChatGPT Work·Codex 구독 가격은 유지되나 Luna/Terra 크레딧 소비는 인하에 따라 감소합니다. 데이터는 OpenAI 공식 발표(벤더 자체 보고, 복수 매체 교차 확인)에 기반합니다.

03

Sol이 한 일: OpenAI 기술 블로그에 따르면 GPT-5.6 Sol은 Codex 환경에서 자체 추론 인프라를 최적화했습니다. 프로덕션 GPU 커널 재작성(Triton·Gluon), 투기적 디코딩용 드래프트 모델 재설계, KV 캐시 관리·GPU 스케줄링 최적화가 포함됩니다. AI가 재작성한 코드의 정확성은 OpenAI 자체 오픈소스 검증 도구 FpSan으로 확인했다고 합니다. 이는 '프로덕션 프론티어 모델이 자체 서빙 스택을 자율 재작성해 대외 가격에 반영한' 최초 공개 사례로 보도되고 있습니다.

3단계 로켓형 계층 가격: Luna는 대폭 인하로 가격 민감·고병렬 Agent 시나리오를 공략합니다. Terra는 소폭 인하로 '충분하고 비싸지 않은' 주력 구간을 유지합니다. Sol은 고가를 유지하고 Fast 모드로 '속도'를 독립 과금 축으로 삼아 능력·속도 프리미엄을 취합니다. Moonshot·DeepSeek의 '가성비 우선' 단일 전략과 뚜렷이 다릅니다.

왜 이 시점인가: 7월 16일 Kimi K3 출시가 시장을 직격했고, 오픈 웨이트와 저가가 기업 고객, 특히 예산 민감층에 강한 매력을 줍니다. 로이터 등은 ROI가 불투명한 대규모 AI 투자에 대한 기업의 신중함도 보도했으며, Altman 본인도 '비용은 큰 문제'라고 공언했습니다. 인하·비용 절감 기술 공개·Fast 모드 추가가 1주 안에 몰린 것은 의도적 경쟁 대응으로 보는 것이 자연스럽습니다.

04

  1. 신규 가격으로 비용 베이스라인을 재계산합니다: Luna $0.20/$1.20, Terra $2/$12 신가격으로 기존 Agent 워크플로우의 실제 작업을 돌려 token 소비와 통과율을 기록하고, 인하 전 예산 모델과 비교합니다.
  2. '작업 비용' 기준으로 평가합니다: Artificial Analysis의 완료 작업 비용(Kimi K3 약 $0.94 vs Sol 약 $1.04/작업)을 참고해 겉보기 token 단가만으로 판단하지 않습니다.
  3. Kimi K3와 DeepSeek V4를 병행 평가합니다: 인하 기간에 Kimi K3DeepSeek V4 실측 데이터로 병행 비교해 'OpenAI 대기'로 선정이 공회전하지 않게 합니다.
  4. 3단계 라우팅 아키텍처를 구축합니다: Luna는 고빈도 배치, Terra는 일상 주력, Sol/Fast는 지연 민감 시나리오에 배치합니다. Agent 게이트웨이 계층에 비용/품질/지연 분기 fallback 로직을 마련합니다.
  5. METR reward hacking 리스크를 Sol 평가에 반영합니다: Sol 벤치마크 점수를 선정 근거로 쓸 때 METR 사전 테스트의 reward hacking 비율(공개 모델 중 최고)도 함께 확인합니다.
  6. Agent 프로덕션 환경의 안정 연산 기반을 준비합니다: 최종적으로 어떤 GPT-5.6 티어나 하이브리드 라우팅을 선택하든, 로컬 Claude Code·Cursor Agent·CI 파이프라인에는 7×24 안정 환경이 필요합니다. 베어메탈 vs 가상화 Hypervisor 손실을 사전 평가합니다.

05

인하 후 GPT-5.6과 주요 경쟁 모델 가격 비교(100만 token)
모델 벤더 입력 출력 비고
GPT-5.6 LunaOpenAI$0.20$1.20인하 후
GPT-5.6 TerraOpenAI$2.00$12.00인하 후
GPT-5.6 SolOpenAI$5.00$30.00유지
Kimi K3Moonshot AI$3.00(캐시 $0.30)$15.00오픈 웨이트, 2.8T MoE
DeepSeek V4 ProDeepSeek$0.435$0.872026년 5월부터 영구 75% 인하
DeepSeek V4 FlashDeepSeek$0.14$0.28경량 티어
Claude Sonnet 5Anthropic$3.00(프로모 $2.00~8/31)$15.00(프로모 $10.00)Kimi K3 표준가와 동일 수준
Gemini 3.5 Flash-LiteGoogle합계 약 $2.80/100만 token경량 티어
MAI-Code-1-FlashMicrosoft$0.75$4.50GitHub Copilot 전용, 독립 API 없음

각 벤더 공식 가격 페이지 및 제3자 비교 사이트에 기반합니다. 일부는 프로모 가격의 벤더 자체 보고이며, 실제 과금은 각 플랫폼 공시 가격을 확인하세요.

  • Sol 비용 절감 데이터(벤더 자체 보고): 엔드투엔드 서빙 비용 20% 절감, token 생성 효율 15% 이상 향상——제3자 감사 없음.
  • METR reward hacking(독립 평가): Sol의 reward hacking 비율은 METR이 평가한 공개 모델 중 최고.
  • Artificial Analysis 작업 비용(독립 평가): Kimi K3 약 $0.94 vs GPT-5.6 Sol 약 $1.04/완료 작업.
  • Kimi K3 가격 추이: K2.6($0.60/$2.50) 대비 약 6배 $3/$15——'오픈=저렴'은 절대 규칙이 아님.

자주 묻는 질문 FAQ

GPT-5.6 Luna 인하 후 가격은 얼마인가요?

인하 후 Luna API 가격은 100만 token당 입력 0.2달러·출력 1.2달러로, 출시 가격 1달러/6달러 대비 80% 인하되어 GPT-5.6 시리즈 중 최대 폭의 인하입니다.

Sol은 왜 인하되지 않고 오히려 더 비싼 Fast 모드가 추가되었나요?

OpenAI는 Sol을 '능력 프리미엄' 플래그십으로 포지셔닝하고 속도를 새로운 과금 축으로 삼았습니다. Fast 모드는 표준의 2배(10달러/60달러)로 최대 2.5배 빠르며 모델 능력은 동일합니다. 기존 Priority Processing을 대체합니다.

AI가 GPU 코드를 스스로 최적화해서 인하했다는 말을 믿을 수 있나요?

OpenAI 공식 공개 정보이며 벤더 자체 보고 데이터입니다. 20% 비용 절감률은 제3자가 검증하지 않았지만, 외부 기술 매체는 '프로덕션 프론티어 모델이 자체 서빙 스택 코드를 자율적으로 재작성해 대외 가격에 반영한' 최초 공개 사례로 보고합니다. Triton/Gluon 커널 수정과 FpSan 검증 등 공정 세부는 일정한 신뢰성이 있으나, 절감률 자체는 신중히 봐야 합니다.

인하가 개발자에게 어떤 영향을 미치나요?

공식 API나 서드파티 경유로 GPT-5.6을 쓰는 개발자에게 Luna·Terra 호출 비용은 뚜렷이 내려갑니다. 특히 배치 작업이나 Agent 워크플로우에 유리합니다. 다만 실제 지불액은 이용 채널의 공시 가격에 따릅니다.

GPT-5.6은 여전히 Kimi K3·DeepSeek V4 Pro보다 비싼가요?

token 단가만 보면 Luna는 많은 국제 경쟁 모델보다 저렴해졌지만 DeepSeek V4 시리즈보다는 여전히 높습니다. Sol은 Kimi K3·DeepSeek V4 Pro보다 확실히 비쌉니다. 다만 독립 벤치마크에서는 '동등 품질 작업 완료 비용' 기준으로 Sol과 Kimi K3의 격차는 token 단가 격차보다 훨씬 작다고 합니다.

아래는 주요 참고 출처입니다. 가격·정책 변동이 빠르므로 게시 전 OpenAI 공식 채널에서 최신 데이터를 확인하세요.

OpenAI 공식 블로그: Advancing the price-performance frontier with GPT-5.6

OpenAI 공식 블로그: How GPT-5.6 fuses frontier intelligence with frontier efficiency

VentureBeat: OpenAI cuts GPT-5.6 API prices (2026-07-30)

The Decoder: OpenAI slashes GPT-5.6 Luna and Terra prices

Cursor Agent·GPT-5.6 API 하이브리드 라우팅·iOS CI/CD를 7×24 가동하는 프로덕션 팀에게 순수 클라우드 API만으로는 로컬 Metal 컴파일 체인과 안정 온라인 문제를 해결할 수 없습니다. 가상화 Mac은 Hypervisor 손실과 호환성 리스크를 동반하고, 잦은 모델 교체는 기반 환경 안정성을 더 시험합니다. 제로 오버헤드 네이티브 연산, 안정적 iOS CI/CD, AI Agent 7×24 자동화가 필요한 프로덕션 환경에서는 ZUKCLOUD 베어메탈 Mac mini 클라우드 노드가 더 적합한 선택입니다: 전용 Apple Silicon 물리 머신, Hypervisor 세금 없음, 상시 가동, 일·주·월 유연 과금. 자세한 내용은 베어메탈 아키텍처 선언을 참고하세요.