21 августа 2026 OpenAI не выпустила новую модель. Она переписала строку в прайсе. В changelog API у gpt-5.6-sol теперь 4 доллара за миллион входных токенов и 20 за миллион выходных. На карточке GPT-5.6 Sol то же самое: минус 20% на вход, минус 33% на выход, промо как минимум до 21 ноября 2026. На странице GPT-5.6 слоган шире: API и credit pricing «больше чем на 20%» на ближайшие три месяца. «Больше 20%» правда для смеси: выход режут на треть, вход ровно на пятую. Три месяца, не «навсегда». Для вайб-кодера на ключе это те же веса и меньший чек. Модель не стала умнее. Подешевел короткий Standard и слои, которые вендор явно пересчитал от этой базы.

Что именно подешевело 21 августа

Публичная сетка на странице Pricing на 23 августа 2026 даёт короткий контекст Sol так: 4 доллара вход, 0,40 кэш-чтение, 5 долларов запись кэша, 20 долларов выход. Запись кэша по-прежнему 1,25× от сырого входа. Если вход больше 272 тысяч токенов, вендор множит весь запрос: вход 2×, выход 1,5×. Длинный контекст Sol сейчас 8 / 0,80 / 10 / 30 долларов за миллион. Это не отдельная скидка «на длинный промпт». Это та же акция, помноженная на старое правило длинного окна.

До 21 августа короткий Standard сидел на 5 / 30. Отсюда и проценты: 5 к 4 это ровно 20%, 30 к 20 это ровно треть. Кэш-чтение с 0,50 уехало на 0,40, тоже 20%. На том же объёме и том же service_tier июльский инвойс и чек после 21 августа должны разойтись на эти доли. Если нет, смотрите слой, длину входа и инструменты, а не «скидка не применилась».

Алиас gpt-5.6 по-прежнему ведёт на Sol. Смена цены не требует нового model id. Снапшот тот же, меняется биллинг. Luna и Terra в этот апдейт не входят: их OpenAI уже резала 30 июля 2026 (Luna на 80%, Terra на 20%). Cyber в таблице Daybreak остаётся 12,50 / 75. Снимок chat-latest в API всё ещё 5 / 30. Если агент сидит на алиасе чата, а не на gpt-5.6-sol, эта скидка API GPT вас не касается.

Fast, Batch, Flex и Ultrafast: что вошло в промо

Правило одно: цитировать только то, что вендор выложил числом. На 23 августа 2026 картина такая.

  1. Standard. База промо: 4 / 20 на коротком контексте, 8 / 30 на длинном. Это то, что пишет changelog и карточка модели. Если вы не ставите service_tier, вы здесь.
  2. Fast mode. Вошёл. В гайде Fast mode OpenAI прямо пишет: для Sol Fast стоит вдвое от соответствующего Standard. Короткий контекст 8 / 40, длинный 16 / 60. Та же оговорка про промо минимум до 21 ноября 2026. Вкладка Fast на Pricing совпадает: 8 / 0,80 / 10 / 40 короткий и 16 / 1,60 / 20 / 60 длинный. Множитель «вдвое» жив, но считается от новых 4 / 20, не от старых 5 / 30.
  3. Batch и Flex. На сетке 23 августа совпадают и равны половине нового Standard. Короткий контекст 2 / 10, длинный 4 / 15. Кэш и запись кэша пропорциональны. Отдельного пресс-релиза «режем Batch» нет: таблица уже считает от обновлённой базы.
  4. Ultrafast. Не вошёл, потому что цены нет. 13 августа 2026 OpenAI анонсировала слой в changelog и в посте Previewing Ultrafast mode: limited preview, до 14× к Standard, отдельного прайса в сетке нет. Строки Ultrafast на Pricing нет. Закладывать 4 / 20 или 8 / 40 в юнит-экономику Cerebras нельзя. Что это за режим и чем он не Fast, мы держали отдельно: GPT-5.6 Sol Ultrafast на Cerebras.

Итого для кошелька. Скидка сидит на токене Sol в API. Она масштабируется на Fast, Batch и Flex, потому что эти слои вендор публикует как множители от Standard. Она не масштабируется на Ultrafast, потому что множителя нет. Региональная обработка (data residency) для моделей после 5 марта 2026 по-прежнему плюс 10% сверху. Инструменты (web search, file search, контейнер) биллятся отдельно и этой акцией не режутся.

Сколько это на живом счёте, не на миллионе

Строка «4 / 20» сама по себе ещё не бюджет. Агент жжёт вход и выход в разных долях. Выход резали сильнее, поэтому выигрыш растёт там, где модель много пишет: патч, ревью, длинный reasoning. На коротком «да / нет» с жирным системным промптом экономия ближе к 20%.

Цифры нарочно мелкие. Считать надо свой mix входа и выхода за неделю, а не «минус 20% от прошлого инвойса». Если у вас раздутый контекст и короткий ответ, вы получите ближе к входным 20%. Если Sol думает на high или xhigh и пишет простыню, ближе к выходным 33%. Цена успешного шага, а не строка за миллион, по-прежнему главный якорь: сколько стоят токены Claude и GPT.

Где скидка не лечит счёт

Дешёвый токен не чинит пять лишних tool-кругов. Не ужимает монолит, который вы кладёте в промпт «на всякий случай». Не ускоряет очередь. Агент, который три раза читает репозиторий и один раз пишет файл, сожжёт вход на поиске. Минус 20% на этом входе приятны, но дешевле сначала выкинуть мусор. Та же дисциплина, что на квоте подписки: резать вход. Соседний контур: лимиты Claude Code и экономия токенов.

Длинный prefill по-прежнему бьёт по паузе до первого токена. Акция меняет доллары, не TTFT. Если боль в пустом экране, смотрите кэш, длину системного промпта и слой скорости, а не процент в changelog. Ось запуска мы разбирали отдельно: time to first token и инференс LLM.

Как не обмануться формулировкой «больше 20%»

Вендор честно пишет две цифры и одну рекламную. «Over 20%» это зонтик. На входе ровно 20%. На выходе 33%. Смешанный чек почти всегда где-то между ними. Если кто-то обещает «минус треть на весь API», это уже не цитата OpenAI.

  1. Промо, не новый прайс навсегда. Формула на карточке модели: promotional pricing, at least through 21 ноября 2026. После этой даты ставка может вернуться к 5 / 30. Может остаться. Вендор не обещал ни того, ни другого. Закладывать 4 / 20 в годовой unit-экономике как константу рано. Имеет смысл пометить календарь на середину ноября и пересчитать маршрутизацию.
  2. Слой должен совпасть. Fast считается от нового Standard, это вендор написал. Ultrafast не считается ни от чего публичного. Региональный эндпоинт плюсует 10%. Bedrock биллится через AWS и «может отличаться». Свой прокси с наценкой тоже не обязан повторить сетку 21 августа.
  3. Подписка ChatGPT это не этот чек. Changelog и Pricing говорят про API-токены. Карточка GPT-5.6 добавляет credit pricing: кредиты, не ежемесячная плата Plus, Pro и Business. Квота чата не выросла. Если вы платите за подписку и иногда вызываете ключ, дешевеет только ключ.
  4. Младшая модель часто всё ещё дешевле скидочного Sol. Luna на коротком контексте 0,20 / 1,20. Terra 2 / 12. Соль после акции 4 / 20. Если задача закрывается Terra, гоняться за «флагман стал дешевле» бессмысленно: вы купите более дорогой интеллект со скидкой, а не более дешёвый результат. Акция сужает щель, не переворачивает лестницу.
  5. Кэш и длинный вход ломают оценку «на салфетке». Запись кэша 5 долларов за миллион дороже сырого входа 4. Первый прогон с прогревом может выйти дороже, чем вы ждали от «минус 20%». Повтор с попаданием в кэш наоборот дешевле. Окно длиннее 272 тысяч поднимает весь запрос, не только хвост.

Что делать с 23 августа по 21 ноября

Окно короткое. Имеет смысл не «переехать на Sol, потому что скидка», а переложить уже существующий трафик Sol туда, где процент максимален, и не раздувать Fast без нужды.

Если Sol уже в API, акция работает сама: тот же id, меньшая строка. С Terra или Luna вверх из-за заголовка не прыгайте. Задержка: сначала Fast на 8 / 40. Дешёвые задачи акция Sol не лечит. Ultrafast «по цене Standard» вендор не публиковал.

Коротко

21 августа 2026 OpenAI опустила API-цену GPT-5.6 Sol на коротком Standard с 5 / 30 до 4 / 20 долларов за миллион токенов: минус 20% вход, минус 33% выход. Промо держится как минимум до 21 ноября 2026. Fast mode опубликован как 2× этой базы (8 / 40 короткий, 16 / 60 длинный). Batch и Flex сидят на половине (2 / 10 короткий, 4 / 15 длинный). Ultrafast в таблицу не попал: слоя в Pricing нет.

Для вайб-кодера на ключе это скидка на уже купленный интеллект, не повод переехать на флагман с Luna. Смешанный чек почти всегда между 20% и 33%. Подписка в браузере, инструменты и Cerebras-превью этой акцией не закрываются. Первичные источники: changelog от 21 августа, Pricing, карточка Sol, гайд Fast mode и страница GPT-5.6.