Кибер-Миша
Апдейт22 сен 2026· 🇺🇸 OpenAI

OpenAI улучшила кеширование запросов для GPT-6

2026-09-22 OpenAI обновила систему кеширования запросов для семейства GPT-6. Общие фрагменты инструкций, описаний инструментов и контекста теперь могут повторно использоваться в течение 30 минут. По данным OpenAI, это повышает долю обращений к кешу, сокращает время ожидания и дает скидку до 90% на подходящие входные токены; независимых замеров пока нет.

В API появились явные точки разделения кешируемого контекста, предварительная подготовка кеша, панель мониторинга и диагностика промахов. Диагностика показывает причину сбоя и оценивает число токенов, которые пришлось обработать заново. Для GPT-6 также разрешено менять глубину анализа между ответами без потери уже сохраненного контекста. Точные цены в USD за 1M кешированных токенов в публикации не указаны, условия лицензии и доступ к самим моделям не менялись.

Обновление ориентировано на компании с продолжительными рабочими процессами: разработку программ, подготовку исследований и работу корпоративных помощников с постоянным набором документов и инструментов. Экономия зависит от доли неизменного контекста: по данным приведенных OpenAI клиентов, отдельные внедрения снизили расходы на работу модели на 20–36%, но эти результаты нельзя переносить на другие нагрузки без собственного теста. Рассчитать стоимость в рублях по публикации нельзя без цены конкретной модели, объема токенов и применяемого курса USD/RUB; бизнесу стоит сначала измерить долю попаданий в кеш и только затем закладывать экономию в бюджет.

Далее важно проверить, распространяются ли одинаковые правила на все варианты GPT-6 и как долго кеш сохраняется при разных настройках API. Мы будем отслеживать официальные тарифы в USD за 1M токенов и независимые замеры задержки и экономии.

Первоисточник ↗