GPT-5.6 Luna подешевела в пять раз, и у GPT-5.6 заработал кэш промпта
Обновлено: 3 сентября 2026 г.
GPT-5.6 Luna подешевела в пять раз
Ребят, хорошие новости по текстовым моделям. Провайдер пересмотрел тарифы на семейство GPT-5.6, и, поскольку наша цена считается от себестоимости, новые цифры уже действуют — в текстовой студии, у агентов и в публичном API. Ничего включать не нужно.
Новые цены
Цены — в кредитах за миллион токенов, «вход» — то, что вы отправляете модели (вопрос, история, файлы), «выход» — её ответ.
| Модель | Вход: было | Вход: стало | Выход: было | Выход: стало |
|---|---|---|---|---|
| GPT-5.6 Luna | 80 | 16 | 480 | 96 |
| GPT-5.6 Terra | 200 | 160 | 1200 | 960 |
| GPT-5.6 Sol | 400 | 400 | 2400 | 2400 |
| DeepSeek V4 Flash | 11 | 1,1 | 22 | 53 |
| DeepSeek V4 Pro | 49 | 3,2 | 99 | 158 |
Что это значит на практике: диалог с Luna из десяти реплик, который вчера стоил около 5 кредитов, сегодня обходится примерно в 1. Luna стала самой доступной моделью OpenAI на платформе — для черновиков, переписок, разбора документов и агентов, которым важна скорость.
Кэш промпта у GPT-5.6
У Luna, Terra и Sol заработало кэширование промпта. Когда вы продолжаете диалог, системная инструкция и история уже известны модели — провайдер отдаёт их из кэша, а входные токены из кэша стоят в пять раз дешевле обычных: у Luna 3,2 кредита за миллион вместо 16. Это учитывается автоматически: списание считается по фактической стоимости запроса. Сколько токенов пришло из кэша, видно в карточке текста в истории («Из них из кэша») и в поле cached_tokens ответа публичного API.
Честная оговорка: у провайдера кэш пока в тестовом режиме, поэтому доля попаданий не гарантирована. В нашей проверке на длинной системной инструкции второй запрос взял из кэша 2816 из 3188 входных токенов, и его себестоимость упала втрое.
DeepSeek V4: вход почти бесплатно
DeepSeek V4 Flash и Pro перешли на схему «Cache 100%»: все входные токены тарифицируются по цене кэша. Вход у Flash подешевел в десять раз, у Pro — в пятнадцать. Выходные токены при этом подорожали, так что DeepSeek теперь особенно выгоден там, где вы отправляете модели много текста (документы, длинные истории, код), а ответ нужен короткий.
Как попробовать
Студия → Текст → выберите GPT-5.6 Luna или DeepSeek V4 Flash. В публичном API — те же id моделей, цены в GET /v1/models уже обновлены, а у моделей с кэшем появилось поле cached_input_credits_per_1m.
Цены указаны актуальные на сегодня — тарифы моделей со временем меняются.