30 июля 2026 OpenAI обновила API pricing: GPT-5.6 Luna падает с $1,00/$6,00 до $0,20/$1,20 за миллион токенов (−80%), Terra — с $2,50/$15,00 до $2/$12 (−20%), при этом Sol остаётся на $5/$30, а Fast — на $10/$60. Параллельно OpenAI заявляет, что Sol переписал inference GPU kernels через Codex с заявленным −20% serving cost — без снижения end-user цены Sol. Этот технический разбор для AI-инженеров и tech lead'ов, которым после open-weight релиза Kimi K3 и GA DeepSeek V4 нужно перекалибровать API routing stack. Bottom line: price cut задокументирован — quality gap на frontier tasks остаётся workload-dependent; считайте effective task cost, а не list price per token.
01 4 риска budget exposure при неправильном чтении скидки
Анонс −80% на Luna звучит как мгновенная экономия — на практике появляются новые exposure points, если routing и infra не синхронизированы:
- «Самая дешёвая модель побеждает» — fallacy: Luna покрывает volume subtasks; agentic coding pipelines, откалиброванные на Sol, на Luna деградируют по pass rate и растут retry costs — net spend может вырасти.
- Sol price stability ≠ cost reduction для клиента: OpenAI заявляет 20% internal serving savings через Codex-rewritten GPU kernels, но не передаёт margin downstream. Frontier workloads остаются на $5/$30.
- Конкуренты сдвигают benchmark: Kimi K3 ($0,30 cache hit / $3 cache miss in, $15 out) и DeepSeek V4 (peak/off-peak с GA) продолжают давить — Luna cut — прямая контрреакция OpenAI, не structural moat.
- Data residency и compliance: Более дешёвые US API tiers не меняют processing path через OpenAI infra. EU/RU teams должны валидировать DPA, transfer mechanisms и logging до mass routing на Luna.
Одной строкой: тарифы упали, архитектурное решение усложнилось — token price alone не является routing criterion.
02 Подтверждённые GPT-5.6 тарифы с 30.07.2026
Timeline:
- 9 июля 2026: Launch GPT-5.6 family (Sol, Terra, Luna) + ChatGPT Work — Luna $1,00/$6,00, Terra $2,50/$15,00, Sol $5/$30.
- 16–27 июля 2026: Kimi K3 от preview к full open-weight release — pricing и benchmark pressure.
- 20 июля 2026: DeepSeek V4 GA с peak/off-peak tariff logic.
- 30 июля 2026: OpenAI обновляет API prices — Luna −80%, Terra −20%, Sol и Fast без изменений.
| Tier | До | С 30.07.2026 | Δ | Роль |
|---|---|---|---|---|
| Luna | $1,00 / $6,00 | $0,20 / $1,20 | −80% | Economy, volume subtasks |
| Terra | $2,50 / $15,00 | $2,00 / $12,00 | −20% | Balanced mid-tier |
| Sol | $5,00 / $30,00 | $5,00 / $30,00 | Без изменений | Frontier reasoning |
| Fast | $10,00 / $60,00 | $10,00 / $60,00 | Без изменений | Low-latency premium |
Все цены по OpenAI API Pricing page на 30.07.2026. Перед production SLA — проверяйте live page.
03 Sol GPU kernels через Codex и давление китайских labs
GPU kernel rewrite via Codex: OpenAI сообщает, что Sol автономно переписал inference GPU kernels через Codex — workflow, который обычно занимает недели engineer time. Заявленное −20% serving cost reduction частично объясняет, почему Sol остаётся на $5/$30: vendor capture margin, не customer discount. Для клиентов Sol — по-прежнему expensive frontier tier; savings — internal signal.
Competitive context: Luna cut приходит через 3 дня после full open-weight Kimi K3 и 10 дней после DeepSeek V4 GA. Kimi K3: 2,8T MoE, 1M context, SWE-bench Verified 93,4%. DeepSeek V4: CSA/HCA architecture, 1M context, peak/off-peak pricing для 24/7 agent pipelines. OpenAI response: aggressive на Luna/Terra, defensive на Sol.
| Модель | Вендор | Цена (in / out) | Context | Примечание |
|---|---|---|---|---|
| GPT-5.6 Luna (new) | OpenAI | $0,20 / $1,20 | — | −80% с 30.07.2026 |
| GPT-5.6 Terra (new) | OpenAI | $2,00 / $12,00 | — | −20% с 30.07.2026 |
| GPT-5.6 Sol | OpenAI | $5,00 / $30,00 | — | Без изменений; Codex GPU kernels |
| GPT-5.6 Fast | OpenAI | $10,00 / $60,00 | — | Low-latency tier |
| Kimi K3 | Moonshot AI | $0,30 (cache hit) / $3 (miss) in, $15 out | 1M | Open weights с 27.07.2026 |
| DeepSeek V4 Pro | DeepSeek | Peak/off-peak (variable) | 1M | GA с 20.07.2026 |
04 6 шагов routing после GPT-5.6 price cut
- Зафиксировать baseline costs: Экспорт 30-day token usage по tier (Sol/Terra/Luna). Без baseline −80% на Luna не измерим.
- A/B-тест Luna на defined subtasks: Классифицируйте prompts (summarization, classification, extraction) и сравните Luna vs legacy Terra routing — учитывайте pass rate и retry cost.
- Terra как новый default mid-tier: При $2/$12 Terra attractive для daily engineering — меряйте latency и quality vs Sol на real task set.
- Sol только для hard tasks: Multi-step agents, complex reasoning, coding marathons — на Sol. Codex GPU optimization оправдывает price для OpenAI, не автоматически для вашего budget.
- Параллельный benchmark Kimi K3 и DeepSeek V4: См. наши гайды Kimi K3 и DeepSeek V4; pure OpenAI routing игнорирует cheapest alternatives per task type.
- Закрепить local toolchain: API routing не заменяет stable production environment. Для Cursor Agent, iOS CI/CD и 24/7 agent automation на dedicated Apple Silicon — см. bare-metal manifesto.
05 Hard data, FAQ и источники
Июльская price war 2026 сжимает useful shelf life любого API tier до недель. Для mixed stack (OpenAI + chinese labs + local agent toolchain) считается effective task cost — token price × output length × retry rate — не list price.
- Luna price cut: $1,00/$6,00 → $0,20/$1,20 (−80%), effective 30.07.2026.
- Terra price cut: $2,50/$15,00 → $2,00/$12,00 (−20%), effective 30.07.2026.
- Sol / Fast: $5/$30 и $10/$60 без изменений.
- Sol GPU kernel: Codex rewrite, −20% serving cost claimed (vendor-internal).
- Competitive pressure: Kimi K3 open weights (27.07.), DeepSeek V4 GA (20.07.) — direct context для OpenAI reaction.
FAQ
Какие новые тарифы API GPT-5.6 с 30 июля 2026?
Luna: $0,20/$1,20 за миллион input/output токенов (−80%). Terra: $2/$12 (−20%). Sol: $5/$30 без изменений. Fast: $10/$60.
Почему OpenAI снизила Luna и Terra, но не Sol?
Luna и Terra — high-volume tiers под давлением Kimi K3 и DeepSeek V4. Sol — frontier flagship; OpenAI internalizes Codex GPU savings без price cut для клиентов.
Что такое переписывание GPU-ядер Sol через Codex?
Sol автономно переписал inference GPU kernels через Codex с заявленным −20% serving cost при неизменном API tariff $5/$30.
Как новые цены сравниваются с Kimi K3 и DeepSeek V4?
Luna $0,20/$1,20 дешевле на light tasks. Sol $5/$30 дороже — quality/retry workload-dependent. DeepSeek V4 требует peak/off-peak calc.
Нужно ли сразу перестраивать routing?
Структурированно да: baseline, A/B Luna/Terra, Sol для hard tasks, parallel benchmark alternatives.
Primary sources ниже. Prices и vendor claims — verify against official OpenAI channels перед production decisions.
Moonshot AI official blog: Kimi K3
The Verge: GPT-5.6 and Codex coverage
Для команд с Cursor Agent, mixed OpenAI/Kimi/DeepSeek routing или iOS CI/CD 24/7 cloud APIs alone не решают local Metal toolchain stability — virtualized Mac setups дают hypervisor overhead и compatibility risk. Для production workloads с zero-loss native compute, stable iOS CI/CD и 24/7 AI Agent automation ZUKCLOUD bare-metal Mac mini cloud nodes — обычно лучший fit: dedicated Apple Silicon, no hypervisor tax, always-on, flexible daily/weekly/monthly billing. См. bare-metal architecture manifesto.