GPT-5.6 Luna подешевела в пять раз, и у GPT-5.6 заработал кэш промпта

Обновлено: 3 сентября 2026 г.

GPT-5.6 Luna подешевела в пять раз, и у GPT-5.6 заработал кэш промпта

GPT-5.6 Luna подешевела в пять раз

Ребят, хорошие новости по текстовым моделям. Провайдер пересмотрел тарифы на семейство GPT-5.6, и, поскольку наша цена считается от себестоимости, новые цифры уже действуют — в текстовой студии, у агентов и в публичном API. Ничего включать не нужно.

Новые цены

Цены — в кредитах за миллион токенов, «вход» — то, что вы отправляете модели (вопрос, история, файлы), «выход» — её ответ.

МодельВход: былоВход: сталоВыход: былоВыход: стало
GPT-5.6 Luna801648096
GPT-5.6 Terra2001601200960
GPT-5.6 Sol40040024002400
DeepSeek V4 Flash111,12253
DeepSeek V4 Pro493,299158

Что это значит на практике: диалог с Luna из десяти реплик, который вчера стоил около 5 кредитов, сегодня обходится примерно в 1. Luna стала самой доступной моделью OpenAI на платформе — для черновиков, переписок, разбора документов и агентов, которым важна скорость.

Кэш промпта у GPT-5.6

У Luna, Terra и Sol заработало кэширование промпта. Когда вы продолжаете диалог, системная инструкция и история уже известны модели — провайдер отдаёт их из кэша, а входные токены из кэша стоят в пять раз дешевле обычных: у Luna 3,2 кредита за миллион вместо 16. Это учитывается автоматически: списание считается по фактической стоимости запроса. Сколько токенов пришло из кэша, видно в карточке текста в истории («Из них из кэша») и в поле cached_tokens ответа публичного API.

Честная оговорка: у провайдера кэш пока в тестовом режиме, поэтому доля попаданий не гарантирована. В нашей проверке на длинной системной инструкции второй запрос взял из кэша 2816 из 3188 входных токенов, и его себестоимость упала втрое.

DeepSeek V4: вход почти бесплатно

DeepSeek V4 Flash и Pro перешли на схему «Cache 100%»: все входные токены тарифицируются по цене кэша. Вход у Flash подешевел в десять раз, у Pro — в пятнадцать. Выходные токены при этом подорожали, так что DeepSeek теперь особенно выгоден там, где вы отправляете модели много текста (документы, длинные истории, код), а ответ нужен короткий.

Как попробовать

Студия → Текст → выберите GPT-5.6 Luna или DeepSeek V4 Flash. В публичном API — те же id моделей, цены в GET /v1/models уже обновлены, а у моделей с кэшем появилось поле cached_input_credits_per_1m.

Цены указаны актуальные на сегодня — тарифы моделей со временем меняются.

Все статьи блога Genosai