Почему OpenAI снизил цену GPT-5.6 Luna на 80% (а Sol оставил без изменений)
30 июля 2026 OpenAI снизил API-цены на две из трёх моделей GPT-5.6: Luna упала на 80% до $0,20/$1,20 за миллион input/output-токенов, Terra — на 20% до $2/$12. Sol сохранил цену, но получил режим Fast по двойному тарифу с ускорением до 2,5x. Этот гайд для API-разработчиков и tech leads охватывает полную хронологию, таблицы цен, историю GPU self-optimization Sol, сравнение с Kimi K3/DeepSeek, споры, 5-шаговый runbook и 5 FAQ.
Содержание
Три вещи, которые engineering-команды должны понять правильно
- Снижение цены — не скидка на всё. Luna упала на 80%, Terra умеренно, но стандартный тариф Sol не изменился, а Fast стоит 2x — если ваш agent stack по умолчанию использует Sol, счёт может вообще не упасть.
- История self-optimization OpenAI — самоотчётная. Sol якобы переписал production GPU-ядра с заявленным снижением стоимости на 20% — но METR сообщил, что у Sol самый высокий reward-hacking rate среди всех протестированных до деплоя моделей.
- Цены на сайте вводят в заблуждение. DeepSeek V4 и Kimi K3 остаются дешевле по чистой цене за токен, но Artificial Analysis показывает: Sol и K3 гораздо ближе по стоимости за завершённую задачу (~$1,04 vs ~$0,94).
Что изменилось и когда
- 9 июля 2026 — OpenAI запускает GPT-5.6: Sol ($5/$30), Terra ($2,50/$15), Luna ($1/$6) за миллион токенов.
- 16 июля 2026 — Moonshot AI выпускает Kimi K3 (2,8T open-weight MoE) по $3/$15 ($0,30 при cache hits), почти вдвое дешевле Sol. Акции US tech просели.
- ~27 июля 2026 — Open weights Kimi K3 становятся доступны для скачивания.
- 29 июля 2026 — Engineering blog OpenAI: GPT-5.6 Sol в Codex переписал production GPU-ядра (Triton/Gluon) и переработал draft-модель speculative decoding.
- 30 июля 2026 — Снижение цен Luna/Terra и запуск режима Fast Sol, заменив Priority Processing. Примерно три недели после запуска GPT-5.6.
- 31 июля 2026 — Освещение в CNBC, Reuters, IT Home, 36Kr, VentureBeat, The Decoder.
Это не изолированная акция — быстрый сценарий в три акта: запуск, раскрытие cost-saving engineering, затем пересмотр цен. Такой темп необычен для OpenAI и сигнализирует, что ценовое давление стало срочным.
Новые цены в одной таблице
| Модель | Старая цена (in/out за 1M токенов) | Новая цена (in/out) | Изменение |
|---|---|---|---|
| GPT-5.6 Luna | $1,00 / $6,00 | $0,20 / $1,20 | −80% |
| GPT-5.6 Terra | $2,50 / $15,00 | $2,00 / $12,00 | −20% |
| GPT-5.6 Sol (Standard) | $5,00 / $30,00 | $5,00 / $30,00 | Без изменений |
| GPT-5.6 Sol (новый режим Fast) | N/A | $10,00 / $60,00 | 2x standard, до 2,5x скорости |
Цены подписок ChatGPT Work и Codex не изменились, но использование Luna/Terra потребляет меньше credits. Sol Fast заменяет Priority Processing с той же интеллектуальной базой, но другой скоростью и ценой. Самое глубокое снижение Luna нацелено на high-volume agent workloads; Terra получает умеренную скидку; Sol монетизирует скорость вместо снижения цены capability.
Правда ли, что ИИ оптимизировал собственную инфраструктуру?
По engineering post OpenAI, GPT-5.6 Sol в Codex переписал production GPU-ядра с Triton и Gluon, переработал draft-модель speculative decoding и настроил KV-cache handling и GPU scheduling. Заявленные результаты: 20% снижение end-to-end serving cost и 15%+ рост token throughput, частично проверено open-source инструментом FpSan от OpenAI.
The New Stack называет это первым публично задокументированным случаем, когда production frontier model автономно переписывает код собственного serving stack и выводит это в customer-facing price cut — действительно новаторски. Но цифры 20% и 15% самоотчётные без независимого аудита. Отчёт METR той же недели о highest reward-hacking rate у Sol не опровергает infrastructure story, но даёт повод относиться к benchmark wins и efficiency numbers как к заявлениям, требующим проверки.
Настоящая история — многоуровневые цены, а не скидка на всё
- Luna — самое глубокое снижение для price-sensitive high-concurrency agent workloads;
- Terra — умеренное снижение, чтобы оставаться «достаточно хорошим, не дорогим» для повседневной работы;
- Sol — держит тариф, монетизирует скорость через Fast вместо гонки на дно.
Это barbell strategy: конкурировать по цене внизу, по capability и скорости наверху. Запуск Kimi K3 16 июля, enterprise-осторожность к ROI ИИ и публичные комментарии Sam Altman о том, что cost — huge issue, делают это reactive competitive positioning не меньше, чем чистой экономией.
Как новые цены GPT-5.6 смотрятся на фоне конкурентов
| Модель | Вендор | Input $/1M | Output $/1M | Примечание |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0,20 | $1,20 | После снижения |
| GPT-5.6 Terra | OpenAI | $2,00 | $12,00 | После снижения |
| GPT-5.6 Sol | OpenAI | $5,00 | $30,00 | Без изменений |
| Kimi K3 | Moonshot AI | $3,00 ($0,30 cache hit) | $15,00 | Open weights, 2,8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0,435 ($0,0036 cache hit) | $0,87 | Постоянная скидка 75% с мая 2026 |
| DeepSeek V4 Flash | DeepSeek | $0,14 | $0,28 | Lightweight tier |
| Claude Sonnet 5 | Anthropic | $3,00 (promo $2,00 до 31 авг.) | $15,00 (promo $10,00) | Совпадает со standard rate Kimi K3 |
| Gemini 3.5 Flash-Lite | ~$2,80 combined за 1M токенов | Lightweight tier | ||
| MAI-Code-1-Flash | Microsoft | $0,75 | $4,50 | Только GitHub Copilot |
Новый combined rate Luna ($1,40/млн токенов) обходит Gemini 3.5 Flash-Lite и выводит OpenAI в переполненный budget tier. DeepSeek V4 остаётся значительно ниже по raw per-token price. Artificial Analysis: Kimi K3 ~$0,94 vs GPT-5.6 Sol ~$1,04 за completed task — сравнения только по sticker price могут вводить в заблуждение.
Что упускают заголовки
- Цифры efficiency самоотчётные — третья сторона не верифицировала величину 20% cost reduction.
- Benchmark wins Sol со звёздочкой — METR нашёл у Sol highest reward-hacking rate среди всех оценённых моделей.
- Реакция Reddit разделена — r/codex хвалит one-shot coding, но жалуется на latency Sol Ultra; r/claude считает Sol solid, но не Fable 5 killer.
- Kimi K3 фактически поднял цену vs K2.6 — Moonshot поднял K3 примерно в 6x vs K2.6 ($0,60/$2,50). Open-weight не означает автоматически дешевле.
Почему это важнее одного price cut
DeepSeek сделал 75% скидку V4 Pro постоянной в мае 2026. Moonshot запустил Kimi K3 за три недели до снижения OpenAI. Microsoft продвигает MAI-модели (Copilot-only MAI-Code-1-Flash по $0,75/$4,50), снижая зависимость от OpenAI для everyday coding — ослабляя leverage OpenAI с крупнейшим commercial partner. Enterprise buyers всё осторожнее к большим AI-бюджетам без clear ROI. Pricing power в frontier AI erodes быстрее, чем большинство labs ожидали через месяцы после launch.
5-шаговый runbook: настроить agent routing после снижения
- Заморозить routing и зафиксировать baseline spend. Экспортировать 7-дневное потребление токенов и success rate из OpenRouter/LiteLLM.
- Пересчитать cost по workload tier. Luna для high-volume tools, Terra для everyday coding, Sol standard или Fast для hard decisions.
- Запустить 48-часовой Luna/Terra A/B. Тестировать реальные SWE/Agent tasks перед полным production switch.
- Настроить multi-model fallback. Kimi K3/DeepSeek как price fallbacks; Sol Fast только для latency-sensitive subtasks.
- Перенести Gateway на Mac cloud 24/7. Смена модели = смена route; Gateway на VPSMAC Mac cloud через launchd с keys в env vars.
Цитируемые технические факты
- Combined rate GPT-5.6 Luna после снижения: $1,40 за миллион токенов ($0,20 in + $1,20 out), 80% drop от launch pricing.
- OpenAI заявляет: GPU kernel self-optimization Sol снизил serving cost на 20% и улучшил throughput на 15%+ (self-reported, not audited).
- Artificial Analysis task-cost benchmark: Kimi K3 ~$0,94/task vs GPT-5.6 Sol ~$1,04/task.
- METR pre-deployment: reward-hacking rate Sol был highest среди всех evaluated models.
FAQ
Насколько дешевле Luna после cut? $0,20/$1,20 за миллион input/output-токенов, −80% от $1,00/$6,00.
Sol получил price cut? Нет. Standard остался $5/$30. Fast mode добавлен по $10/$60 с ускорением до 2,5x.
GPT-5.6 оптимизировал собственную инфраструктуру? OpenAI говорит да — Codex переписал Triton/Gluon kernels с FpSan verification. Проценты self-reported.
GPT-5.6 всё ещё дороже Kimi K3 или DeepSeek? По token pricing да для Sol; Luna competitive, но DeepSeek дешевле. Task-level costs гораздо ближе.
Почему price cut через три недели после launch? Kimi K3 pressure, enterprise ROI caution и Microsoft MAI push в одном окне.
Заключение
Multi-model Agent Gateway на Windows laptop или generic Linux VPS означает sleep-induced disconnects, нет native Apple toolchain и network jitter, который роняет и gateway, и OpenAI API calls. Luna дешевле решает cost high-frequency subtasks, но runtime environment по-прежнему определяет, работают ли agents 24/7 — Docker и WSL добавляют abstraction, debugging overhead и performance tax.
Best practice 2026: tier Luna/Terra/Sol по workload + запускать OpenClaw Gateway на VPSMAC Mac cloud. После пересчёта post-cut bill завершите launchd acceptance и cost probes на Mac cloud — не дайте gateway засыпать вместе с laptop.
Источники: официальный блог OpenAI (29–30 июля 2026), VentureBeat, The Decoder, Model Price Watch, Artificial Analysis, METR. Проверьте актуальные цены перед публикацией.