Корзина Войти
Каталог

Кэш промптов в GPT-6: скидка до 90% на повторный контекст и окно в 30 минут

OpenAI обновила кэширование промптов для моделей семейства GPT-6. Общий контекст, который повторяется от запроса к запросу, теперь по умолчанию чаще берётся из кэша, скидка на такие входные токены доходит до 90%, а повторное использование засчитывается в окне 30 минут. Вместе с этим компания выпустила панель мониторинга кэша и инструмент, который объясняет, почему кэш не сработал. Подробности в анонсе OpenAI.

Зачем это нужно

Агенты на GPT-6 работают часами: рефакторят код, собирают документы и презентации. Каждый их шаг это новый запрос к API, и в каждом снова едут одни и те же инструкции, описания инструментов и контекст прошлых ходов. Если этот общий кусок взят из кэша, ответ приходит быстрее, а платите вы за него до 90% меньше. Цены самих моделей мы разбирали в материале про GPT-6 Astra в API.

Что появилось нового

  • Панель Prompt Caching Dashboard показывает, какая доля входных токенов пришла из кэша, как менялся процент попаданий и сколько токенов оплачено по полной цене.
  • Диагностика промахов. Запрос сравнивается с недавним ответом, и инструмент называет причину: сменилась модель, инструменты, настройки или вход. Заодно оценивает, сколько токенов потеряно.
  • Явные точки кэширования. Можно самому указать, какой префикс промпта держать в кэше.
  • Смена reasoning effort без сброса кэша. На моделях GPT-6 усилие рассуждения можно поднять или опустить между ответами через configuration_update, и накопленный контекст не пропадает.
  • Прогрев. Общие инструкции и справочные материалы можно загрузить в кэш заранее, при старте приложения, чтобы первый ответ пользователю пришёл быстрее.

Как не терять кэш на практике

Главный совет OpenAI: не трогайте начало контекста. Описания инструментов, их схемы и порядок держите неизменными. Если инструмент на этом шаге не нужен, ограничьте список через allowed_tools или поставьте tool_choice в none, а не удаляйте описание. Новые указания модели добавляйте отдельным developer-сообщением в конец, а не переписывайте старые. Любая правка в начале промпта обнуляет всё, что шло после неё.

Что это значит для нас

Новость касается тех, кто платит за API: разработчиков и тех, кто гоняет своих агентов. Если вы пользуетесь ChatGPT в браузере или в приложении, ничего делать не нужно, тариф подписки от этого не меняется.

С оплатой всё по-прежнему: российскую карту OpenAI не принимает ни за подписку, ни за API. Подписка ChatGPT Plus и Pro есть в нашем каталоге, оплата картой РФ или СБП.

Коротко

  • Кэш промптов GPT-6 чаще срабатывает по умолчанию, скидка на кэшированный вход до 90%.
  • Повтор общего префикса засчитывается в окне 30 минут.
  • Новые инструменты: панель мониторинга, диагностика промахов, явные точки кэширования, прогрев.
  • Reasoning effort на GPT-6 меняется между ответами без потери кэша.
Перейти в каталог
3 мин чтения
0
Войдите, чтобы ответить
Войти
Здесь пока тихо. Напишите первым.