💻 OpenAI улучшила промпт-кэширование для GPT-6

Выросли cache hit rate, появились явные точки остановки кэша (параметры prompt_cache_options.mode и prompt_cache_breakpoint), инструмент Prompt Cache Diagnostics и «прогрев» кэша до запроса. Скидка на кэшированные входные токены достигает 90%: запись — 1,25x цены входа, чтение — 0,1x.

🌍 Кэширование становится управляемой частью API-контракта, а не скрытой серверной оптимизацией: границы кэша задаются явно, reasoning effort можно менять между ответами без сброса кэша.

👤 Работаете с API OpenAI? Проверьте hit rate на Prompt Caching Dashboard и поставьте явные breakpoint'ы. Для повторяющихся промптов от 1 024 токенов это способ платить до 10% обычной цены за входные токены и быстрее получать первый токен ответа.

Источник 1: https://openai.com/index/better-prompt-caching-for-gpt-6 Источник 2: https://developers.openai.com/api/docs/guides/prompt-caching