Главная / Блог / GPT-5.6 цены
ENGINEERING BLOG · 2026.07.31

Снижение цен GPT-5.6:
Luna −80%, Terra −20% — что меняется на практике

30 июля 2026 OpenAI обновила API pricing: GPT-5.6 Luna падает с $1,00/$6,00 до $0,20/$1,20 за миллион токенов (−80%), Terra — с $2,50/$15,00 до $2/$12 (−20%), при этом Sol остаётся на $5/$30, а Fast — на $10/$60. Параллельно OpenAI заявляет, что Sol переписал inference GPU kernels через Codex с заявленным −20% serving cost — без снижения end-user цены Sol. Этот технический разбор для AI-инженеров и tech lead'ов, которым после open-weight релиза Kimi K3 и GA DeepSeek V4 нужно перекалибровать API routing stack. Bottom line: price cut задокументирован — quality gap на frontier tasks остаётся workload-dependent; считайте effective task cost, а не list price per token.

01

Анонс −80% на Luna звучит как мгновенная экономия — на практике появляются новые exposure points, если routing и infra не синхронизированы:

  • «Самая дешёвая модель побеждает» — fallacy: Luna покрывает volume subtasks; agentic coding pipelines, откалиброванные на Sol, на Luna деградируют по pass rate и растут retry costs — net spend может вырасти.
  • Sol price stability ≠ cost reduction для клиента: OpenAI заявляет 20% internal serving savings через Codex-rewritten GPU kernels, но не передаёт margin downstream. Frontier workloads остаются на $5/$30.
  • Конкуренты сдвигают benchmark: Kimi K3 ($0,30 cache hit / $3 cache miss in, $15 out) и DeepSeek V4 (peak/off-peak с GA) продолжают давить — Luna cut — прямая контрреакция OpenAI, не structural moat.
  • Data residency и compliance: Более дешёвые US API tiers не меняют processing path через OpenAI infra. EU/RU teams должны валидировать DPA, transfer mechanisms и logging до mass routing на Luna.

Одной строкой: тарифы упали, архитектурное решение усложнилось — token price alone не является routing criterion.

02

Timeline:

  • 9 июля 2026: Launch GPT-5.6 family (Sol, Terra, Luna) + ChatGPT Work — Luna $1,00/$6,00, Terra $2,50/$15,00, Sol $5/$30.
  • 16–27 июля 2026: Kimi K3 от preview к full open-weight release — pricing и benchmark pressure.
  • 20 июля 2026: DeepSeek V4 GA с peak/off-peak tariff logic.
  • 30 июля 2026: OpenAI обновляет API prices — Luna −80%, Terra −20%, Sol и Fast без изменений.
GPT-5.6 API pricing — до / после (за 1M tokens, input/output)
Tier До С 30.07.2026 Δ Роль
Luna$1,00 / $6,00$0,20 / $1,20−80%Economy, volume subtasks
Terra$2,50 / $15,00$2,00 / $12,00−20%Balanced mid-tier
Sol$5,00 / $30,00$5,00 / $30,00Без измененийFrontier reasoning
Fast$10,00 / $60,00$10,00 / $60,00Без измененийLow-latency premium

Все цены по OpenAI API Pricing page на 30.07.2026. Перед production SLA — проверяйте live page.

03

GPU kernel rewrite via Codex: OpenAI сообщает, что Sol автономно переписал inference GPU kernels через Codex — workflow, который обычно занимает недели engineer time. Заявленное −20% serving cost reduction частично объясняет, почему Sol остаётся на $5/$30: vendor capture margin, не customer discount. Для клиентов Sol — по-прежнему expensive frontier tier; savings — internal signal.

Competitive context: Luna cut приходит через 3 дня после full open-weight Kimi K3 и 10 дней после DeepSeek V4 GA. Kimi K3: 2,8T MoE, 1M context, SWE-bench Verified 93,4%. DeepSeek V4: CSA/HCA architecture, 1M context, peak/off-peak pricing для 24/7 agent pipelines. OpenAI response: aggressive на Luna/Terra, defensive на Sol.

GPT-5.6 vs Kimi K3 vs DeepSeek V4 — API pricing (input/output за 1M tokens)
Модель Вендор Цена (in / out) Context Примечание
GPT-5.6 Luna (new)OpenAI$0,20 / $1,20−80% с 30.07.2026
GPT-5.6 Terra (new)OpenAI$2,00 / $12,00−20% с 30.07.2026
GPT-5.6 SolOpenAI$5,00 / $30,00Без изменений; Codex GPU kernels
GPT-5.6 FastOpenAI$10,00 / $60,00Low-latency tier
Kimi K3Moonshot AI$0,30 (cache hit) / $3 (miss) in, $15 out1MOpen weights с 27.07.2026
DeepSeek V4 ProDeepSeekPeak/off-peak (variable)1MGA с 20.07.2026

04

  1. Зафиксировать baseline costs: Экспорт 30-day token usage по tier (Sol/Terra/Luna). Без baseline −80% на Luna не измерим.
  2. A/B-тест Luna на defined subtasks: Классифицируйте prompts (summarization, classification, extraction) и сравните Luna vs legacy Terra routing — учитывайте pass rate и retry cost.
  3. Terra как новый default mid-tier: При $2/$12 Terra attractive для daily engineering — меряйте latency и quality vs Sol на real task set.
  4. Sol только для hard tasks: Multi-step agents, complex reasoning, coding marathons — на Sol. Codex GPU optimization оправдывает price для OpenAI, не автоматически для вашего budget.
  5. Параллельный benchmark Kimi K3 и DeepSeek V4: См. наши гайды Kimi K3 и DeepSeek V4; pure OpenAI routing игнорирует cheapest alternatives per task type.
  6. Закрепить local toolchain: API routing не заменяет stable production environment. Для Cursor Agent, iOS CI/CD и 24/7 agent automation на dedicated Apple Silicon — см. bare-metal manifesto.

05

Июльская price war 2026 сжимает useful shelf life любого API tier до недель. Для mixed stack (OpenAI + chinese labs + local agent toolchain) считается effective task cost — token price × output length × retry rate — не list price.

  • Luna price cut: $1,00/$6,00 → $0,20/$1,20 (−80%), effective 30.07.2026.
  • Terra price cut: $2,50/$15,00 → $2,00/$12,00 (−20%), effective 30.07.2026.
  • Sol / Fast: $5/$30 и $10/$60 без изменений.
  • Sol GPU kernel: Codex rewrite, −20% serving cost claimed (vendor-internal).
  • Competitive pressure: Kimi K3 open weights (27.07.), DeepSeek V4 GA (20.07.) — direct context для OpenAI reaction.

FAQ

Какие новые тарифы API GPT-5.6 с 30 июля 2026?

Luna: $0,20/$1,20 за миллион input/output токенов (−80%). Terra: $2/$12 (−20%). Sol: $5/$30 без изменений. Fast: $10/$60.

Почему OpenAI снизила Luna и Terra, но не Sol?

Luna и Terra — high-volume tiers под давлением Kimi K3 и DeepSeek V4. Sol — frontier flagship; OpenAI internalizes Codex GPU savings без price cut для клиентов.

Что такое переписывание GPU-ядер Sol через Codex?

Sol автономно переписал inference GPU kernels через Codex с заявленным −20% serving cost при неизменном API tariff $5/$30.

Как новые цены сравниваются с Kimi K3 и DeepSeek V4?

Luna $0,20/$1,20 дешевле на light tasks. Sol $5/$30 дороже — quality/retry workload-dependent. DeepSeek V4 требует peak/off-peak calc.

Нужно ли сразу перестраивать routing?

Структурированно да: baseline, A/B Luna/Terra, Sol для hard tasks, parallel benchmark alternatives.

Primary sources ниже. Prices и vendor claims — verify against official OpenAI channels перед production decisions.

OpenAI API Pricing (official)

Moonshot AI official blog: Kimi K3

DeepSeek official site

The Verge: GPT-5.6 and Codex coverage

Для команд с Cursor Agent, mixed OpenAI/Kimi/DeepSeek routing или iOS CI/CD 24/7 cloud APIs alone не решают local Metal toolchain stability — virtualized Mac setups дают hypervisor overhead и compatibility risk. Для production workloads с zero-loss native compute, stable iOS CI/CD и 24/7 AI Agent automation ZUKCLOUD bare-metal Mac mini cloud nodes — обычно лучший fit: dedicated Apple Silicon, no hypervisor tax, always-on, flexible daily/weekly/monthly billing. См. bare-metal architecture manifesto.