21 августа 2026 OpenAI не выпустила новую модель. Она переписала строку в прайсе. В changelog API у gpt-5.6-sol теперь 4 доллара за миллион входных токенов и 20 за миллион выходных. На карточке GPT-5.6 Sol то же самое: минус 20% на вход, минус 33% на выход, промо как минимум до 21 ноября 2026. На странице GPT-5.6 слоган шире: API и credit pricing «больше чем на 20%» на ближайшие три месяца. «Больше 20%» правда для смеси: выход режут на треть, вход ровно на пятую. Три месяца, не «навсегда». Для вайб-кодера на ключе это те же веса и меньший чек. Модель не стала умнее. Подешевел короткий Standard и слои, которые вендор явно пересчитал от этой базы.
Что именно подешевело 21 августа
Публичная сетка на странице Pricing на 23 августа 2026 даёт короткий контекст Sol так: 4 доллара вход, 0,40 кэш-чтение, 5 долларов запись кэша, 20 долларов выход. Запись кэша по-прежнему 1,25× от сырого входа. Если вход больше 272 тысяч токенов, вендор множит весь запрос: вход 2×, выход 1,5×. Длинный контекст Sol сейчас 8 / 0,80 / 10 / 30 долларов за миллион. Это не отдельная скидка «на длинный промпт». Это та же акция, помноженная на старое правило длинного окна.
До 21 августа короткий Standard сидел на 5 / 30. Отсюда и проценты: 5 к 4 это ровно 20%, 30 к 20 это ровно треть. Кэш-чтение с 0,50 уехало на 0,40, тоже 20%. На том же объёме и том же service_tier июльский инвойс и чек после 21 августа должны разойтись на эти доли. Если нет, смотрите слой, длину входа и инструменты, а не «скидка не применилась».
Алиас gpt-5.6 по-прежнему ведёт на Sol. Смена цены не требует нового model id. Снапшот тот же, меняется биллинг. Luna и Terra в этот апдейт не входят: их OpenAI уже резала 30 июля 2026 (Luna на 80%, Terra на 20%). Cyber в таблице Daybreak остаётся 12,50 / 75. Снимок chat-latest в API всё ещё 5 / 30. Если агент сидит на алиасе чата, а не на gpt-5.6-sol, эта скидка API GPT вас не касается.
Fast, Batch, Flex и Ultrafast: что вошло в промо
Правило одно: цитировать только то, что вендор выложил числом. На 23 августа 2026 картина такая.
- Standard. База промо: 4 / 20 на коротком контексте, 8 / 30 на длинном. Это то, что пишет changelog и карточка модели. Если вы не ставите
service_tier, вы здесь. - Fast mode. Вошёл. В гайде Fast mode OpenAI прямо пишет: для Sol Fast стоит вдвое от соответствующего Standard. Короткий контекст 8 / 40, длинный 16 / 60. Та же оговорка про промо минимум до 21 ноября 2026. Вкладка Fast на Pricing совпадает: 8 / 0,80 / 10 / 40 короткий и 16 / 1,60 / 20 / 60 длинный. Множитель «вдвое» жив, но считается от новых 4 / 20, не от старых 5 / 30.
- Batch и Flex. На сетке 23 августа совпадают и равны половине нового Standard. Короткий контекст 2 / 10, длинный 4 / 15. Кэш и запись кэша пропорциональны. Отдельного пресс-релиза «режем Batch» нет: таблица уже считает от обновлённой базы.
- Ultrafast. Не вошёл, потому что цены нет. 13 августа 2026 OpenAI анонсировала слой в changelog и в посте Previewing Ultrafast mode: limited preview, до 14× к Standard, отдельного прайса в сетке нет. Строки Ultrafast на Pricing нет. Закладывать 4 / 20 или 8 / 40 в юнит-экономику Cerebras нельзя. Что это за режим и чем он не Fast, мы держали отдельно: GPT-5.6 Sol Ultrafast на Cerebras.
Итого для кошелька. Скидка сидит на токене Sol в API. Она масштабируется на Fast, Batch и Flex, потому что эти слои вендор публикует как множители от Standard. Она не масштабируется на Ultrafast, потому что множителя нет. Региональная обработка (data residency) для моделей после 5 марта 2026 по-прежнему плюс 10% сверху. Инструменты (web search, file search, контейнер) биллятся отдельно и этой акцией не режутся.
Сколько это на живом счёте, не на миллионе
Строка «4 / 20» сама по себе ещё не бюджет. Агент жжёт вход и выход в разных долях. Выход резали сильнее, поэтому выигрыш растёт там, где модель много пишет: патч, ревью, длинный reasoning. На коротком «да / нет» с жирным системным промптом экономия ближе к 20%.
- Один ход агента: 8 000 входа, 2 000 выхода. Старый Standard: 0,04 + 0,06 = 0,10 доллара. Новый: 0,032 + 0,04 = 0,072. Минус 28%. Тот же ход в Fast: было бы 0,20 по старой логике 10 / 60, сейчас 0,144 по 8 / 40. Слой скорости по-прежнему вдвое дороже своего Standard, но уже от новой базы.
- Сессия в редакторе: 50 000 входа, 8 000 выхода. Старый Standard 0,25 + 0,24 = 0,49. Новый 0,20 + 0,16 = 0,36. Минус примерно 27%. Если половина входа сидит в кэше, чтение идёт по 0,40 за миллион, не по 4. Акция не отменяет кэш: она его тоже опустила на 20%.
- Месяц плотного кода: 2 млн входа и 400 тысяч выхода на Standard. Старое 10 + 12 = 22 доллара. Новое 8 + 8 = 16. Шесть долларов сэкономили на одном контуре. На Fast те же токены: 16 + 16 = 32 вместо прежних 20 + 24 = 44. Если ночной прогон уезжает в Batch, короткая сетка 2 / 10 даёт 4 + 4 = 8 долларов вместо старых 5 + 6 = 11.
Цифры нарочно мелкие. Считать надо свой mix входа и выхода за неделю, а не «минус 20% от прошлого инвойса». Если у вас раздутый контекст и короткий ответ, вы получите ближе к входным 20%. Если Sol думает на high или xhigh и пишет простыню, ближе к выходным 33%. Цена успешного шага, а не строка за миллион, по-прежнему главный якорь: сколько стоят токены Claude и GPT.
Где скидка не лечит счёт
Дешёвый токен не чинит пять лишних tool-кругов. Не ужимает монолит, который вы кладёте в промпт «на всякий случай». Не ускоряет очередь. Агент, который три раза читает репозиторий и один раз пишет файл, сожжёт вход на поиске. Минус 20% на этом входе приятны, но дешевле сначала выкинуть мусор. Та же дисциплина, что на квоте подписки: резать вход. Соседний контур: лимиты Claude Code и экономия токенов.
Длинный prefill по-прежнему бьёт по паузе до первого токена. Акция меняет доллары, не TTFT. Если боль в пустом экране, смотрите кэш, длину системного промпта и слой скорости, а не процент в changelog. Ось запуска мы разбирали отдельно: time to first token и инференс LLM.
Как не обмануться формулировкой «больше 20%»
Вендор честно пишет две цифры и одну рекламную. «Over 20%» это зонтик. На входе ровно 20%. На выходе 33%. Смешанный чек почти всегда где-то между ними. Если кто-то обещает «минус треть на весь API», это уже не цитата OpenAI.
- Промо, не новый прайс навсегда. Формула на карточке модели: promotional pricing, at least through 21 ноября 2026. После этой даты ставка может вернуться к 5 / 30. Может остаться. Вендор не обещал ни того, ни другого. Закладывать 4 / 20 в годовой unit-экономике как константу рано. Имеет смысл пометить календарь на середину ноября и пересчитать маршрутизацию.
- Слой должен совпасть. Fast считается от нового Standard, это вендор написал. Ultrafast не считается ни от чего публичного. Региональный эндпоинт плюсует 10%. Bedrock биллится через AWS и «может отличаться». Свой прокси с наценкой тоже не обязан повторить сетку 21 августа.
- Подписка ChatGPT это не этот чек. Changelog и Pricing говорят про API-токены. Карточка GPT-5.6 добавляет credit pricing: кредиты, не ежемесячная плата Plus, Pro и Business. Квота чата не выросла. Если вы платите за подписку и иногда вызываете ключ, дешевеет только ключ.
- Младшая модель часто всё ещё дешевле скидочного Sol. Luna на коротком контексте 0,20 / 1,20. Terra 2 / 12. Соль после акции 4 / 20. Если задача закрывается Terra, гоняться за «флагман стал дешевле» бессмысленно: вы купите более дорогой интеллект со скидкой, а не более дешёвый результат. Акция сужает щель, не переворачивает лестницу.
- Кэш и длинный вход ломают оценку «на салфетке». Запись кэша 5 долларов за миллион дороже сырого входа 4. Первый прогон с прогревом может выйти дороже, чем вы ждали от «минус 20%». Повтор с попаданием в кэш наоборот дешевле. Окно длиннее 272 тысяч поднимает весь запрос, не только хвост.
Что делать с 23 августа по 21 ноября
Окно короткое. Имеет смысл не «переехать на Sol, потому что скидка», а переложить уже существующий трафик Sol туда, где процент максимален, и не раздувать Fast без нужды.
- Оставьте Sol там, где он уже нужен. Сложный дифф, жёсткий ревью, инцидент, архитектура. На этих ходах выход обычно толстый, 33% заметны. Не тащите на Sol ежедневный перевод комментариев и переименование переменных: Luna после июльского среза всё ещё другой порядок цены.
- Fast покупайте за стену часов, не за скидку. Слой теперь 8 / 40, не 10 / 60. Это всё ещё вдвое к Standard. Если патч на Standard терпим, акция не делает Fast «почти даром». Если интерактив ломается на 40 секундах печати, Fast остаётся единственной общедоступной полкой скорости. Ultrafast в эту развилку не кладите: прайса нет, preview узкий.
- Ночь и оценки уезжают в Batch или Flex. 2 / 10 на коротком контексте. Для прогона датасета и рефакторинга без человека в контуре это прямой выигрыш. Живой чат туда не кладите: Batch живёт часами, Flex это другой слой задержки, не замена интерактива.
- Пометьте модель в коде явно.
gpt-5.6-sol, не голыйgpt-5.6, если хотите читать инвойс без сюрприза алиаса. Группируйте Usage по service tier: у GPT-5.6 Fast в дашборде часто светится какpriority, даже если в запросе стоитfast. Иначе скидку и надбавку за скорость вы склеите в одну кучу. - Не стройте годовой бюджет на 4 / 20. Три месяца. После 21 ноября перечитайте Pricing. Если ставка откатится, маршрутизация «всё на Sol, потому что почти Terra» развалится за ночь.
Если Sol уже в API, акция работает сама: тот же id, меньшая строка. С Terra или Luna вверх из-за заголовка не прыгайте. Задержка: сначала Fast на 8 / 40. Дешёвые задачи акция Sol не лечит. Ultrafast «по цене Standard» вендор не публиковал.
Коротко
21 августа 2026 OpenAI опустила API-цену GPT-5.6 Sol на коротком Standard с 5 / 30 до 4 / 20 долларов за миллион токенов: минус 20% вход, минус 33% выход. Промо держится как минимум до 21 ноября 2026. Fast mode опубликован как 2× этой базы (8 / 40 короткий, 16 / 60 длинный). Batch и Flex сидят на половине (2 / 10 короткий, 4 / 15 длинный). Ultrafast в таблицу не попал: слоя в Pricing нет.
Для вайб-кодера на ключе это скидка на уже купленный интеллект, не повод переехать на флагман с Luna. Смешанный чек почти всегда между 20% и 33%. Подписка в браузере, инструменты и Cerebras-превью этой акцией не закрываются. Первичные источники: changelog от 21 августа, Pricing, карточка Sol, гайд Fast mode и страница GPT-5.6.
