Архив рубрики ~Лента новостей~

Улучшенное кэширование подсказок для GPT-6 | OpenAI

Улучшенное кэширование подсказок для GPT-6 | OpenAI
Улучшенное кэширование подсказок для GPT-6 | OpenAI

Более высокие показатели попадания в кэш и новые инструменты, помогающие постоянным агентам работать быстрее и дешевле.

  • Мониторинг кэширования и диагностика промахов кэша.
  • Оптимизируйте кэширование для вашего приложения.
  • Начать
  • Мониторинг кэширования и диагностика промахов кэша.
  • Оптимизируйте кэширование для вашего приложения.
  • Начать

GPT-6 позволяет постоянным агентам работать часами над сложными задачами, от рефакторинга кодовых баз до создания тщательно подготовленных документов и презентаций. Приложения, лежащие в основе этих агентов, отправляют серию запросов к API, которые основываются друг на друге, часто передавая те же инструкции, определения инструментов и контекст из предыдущих обращений. OpenAI кэширует этот общий контекст для повторного использования вычислений в разных запросах, сокращая время ответа и предоставляя разработчикам скидки до 90% на кэшированные входные токены.

В семействе GPT-6 мы внедрили улучшенную систему кэширования запросов, которая по умолчанию обеспечивает более высокие показатели попадания в кэш. Теперь мы предоставляем скидки на кэширование для соответствующих общих префиксов, повторно используемых в течение 30-минутного окна. Мы также представляем новые инструменты, которые помогут разработчикам отслеживать производительность кэша, диагностировать промахи и выбирать, какой объем запроса следует кэшировать.

« Кэширование запросов OpenAI играет решающую роль в обеспечении быстрой и эффективной работы GitHub Copilot в масштабах предприятия. За последние несколько месяцев нам удалось сократить более чем на 50% долю токенов запросов, требующих повторной обработки в миллиардах запросов к моделям OpenAI, по сравнению с нашим предыдущим базовым уровнем. В результате мы получили более эффективную систему вывода и более быстрое время получения первого ответа для разработчиков».

—Марио Родригес, директор по продуктам

Мониторинг кэширования и диагностика промахов кэша.

Новая панель мониторинга кэширования запросов (открывается в новом окне) показывает, какая часть входных данных вашего приложения обрабатывается из кэша. Отслеживайте показатели попаданий в кэш с течением времени и используйте диаграмму состава входных данных для сравнения кэшированных и некэшированных токенов. Эти представления помогут вам выявить снижение количества попаданий в кэш и оценить, как изменения в вашем приложении влияют на производительность кэширования.

При неожиданном промахе кэша воспользуйтесь инструментом диагностики кэширования ( откроется в новом окне), чтобы понять, что произошло. Сравните запрос с недавним ответом, чтобы выявить изменения в модели, инструментах, настройках или входных данных, которые препятствовали повторному использованию. Примерное количество затронутых токенов поможет вам оценить масштаб последствий и решить, как оптимизировать интеграцию для максимизации коэффициента попадания в кэш.

{ «prompt_cache_diagnostics»: { «type»: «cache_miss», «reason»: «tools_changed», «comparison_reusable_tokens»: 5629, «cache_missed_tokens»: 5629 } }

Оптимизируйте кэширование для вашего приложения.

Выберите, что кэшировать. Явные точки останова кэширования позволяют выбрать, какие префиксы подсказок использовать повторно. В обновленном руководстве по кэшированию подсказок (открывается в новом окне) объясняется, как их использовать, как долго кэшированные префиксы остаются доступными и как изменения в инструментах и входных данных влияют на их повторное использование.

Настройте сложность рассуждений без нарушения работы кэша. В моделях GPT-6 теперь можно изменять сложность рассуждений (открывается в новом окне) между ответами без нарушения работы кэша. Увеличьте сложность для более сложной задачи или уменьшите ее для рутинного последующего действия, добавив параметр configuration_update , оставив при этом сложность рассуждений на уровне запроса неизменной. Это позволяет регулировать объем рассуждений, необходимых для выполнения задачи, сохраняя при этом многократно используемый контекст.

Сохраняйте кэш по мере изменения инструментов и инструкций. По мере изменения потребностей вашего агента в использовании инструментов, поддерживайте стабильность определений инструментов, схем и порядка их применения, чтобы предыдущий контекст оставался пригодным для повторного использования. Используйте allowed_tools , чтобы сделать доступными только соответствующие инструменты, или установите tool_choice в значение none, если инструменты не требуются, вместо удаления определений. Используйте новые сообщения разработчика, чтобы добавлять новые инструкции в конец контекста и перезаписывать старые. См. наши рекомендации по управлению изменениями инструментов (открывается в новом окне) .

Предварительно прогрейте кэш, чтобы уменьшить задержку. Предварительная подготовка (открывается в новом окне) заранее подготавливает известный контекст, чтобы модель могла начать реагировать раньше, когда поступит запрос. Например, приложение может предварительно подготовить общие инструкции, определения инструментов или справочные материалы во время запуска, до того, как пользователь задаст свой первый вопрос. Это выводит обработку данных за пределы времени ожидания пользователя.

Эти дополнительные параметры управления расширяют возможности стандартного механизма кэширования, позволяя адаптировать его к вашей рабочей нагрузке.

1 из 3

« Диагностика кэширования запросов и панель мониторинга OpenAI помогли нам улучшить показатели попадания в кэш на несколько процентных пунктов, снизив затраты на 20%. Теперь мы получаем оповещения о неожиданных сбоях кэширования и используем агенты Codex для диагностики первопричины. Явные точки останова также позволяют нам кэшировать стабильный контекст, сохраняя при этом часто меняющийся контент в конце запроса. Это сделало экономически целесообразным создание форков для фоновых задач, при этом повторно используя почти весь общий контекст».

—Ариан Ханифи, главный технический директор

  • Клубничный браузер
  • Манус
  • Мастер слова

Начать

  • Отслеживайте показатели попаданий в кэш на панели мониторинга кэширования подсказок (откроется в новом окне) .
  • Расследуйте неожиданные сбои с помощью диагностического инструмента (откроется в новом окне) .
  • Следуйте руководству по кэшированию подсказок (открывается в новом окне) , чтобы улучшить свою настройку, или используйте Codex (открывается в новом окне), чтобы проверить свой код, внести улучшения и оценить результаты.

Источник: openai.com

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Коротко из Telegram~ The Curricula AI — ИИ-платформа, которая помогает создавать персонализированные учебные… Архив рубрики ~Коротко из Telegram~ Dream Talk — открытый фреймворк, который создает выразительные видео с… Новости робототехники Оценка Toyota инвестиций в робототехнику в размере 6,4 млрд долларов ставит во главу угла физический искусственный интеллект. Архив рубрики ~Коротко из Telegram~ Исследовательница OpenAI выложила большой конспект по устройству LLM Исследовательница OpenAI… Архив рубрики ~Коротко из Telegram~ Агент прочитал вашу почту — и решил, что вам можно… Архив рубрики ~Коротко из Telegram~ Jina AI прокачала DeepSeek-OCR и ускорила разбор документов Модель рассчитана… Архив рубрики ~Коротко из Telegram~ Anthropic выкатила Claude Opus 5.5 — быстрее, дешевле и сильнее… Архив рубрики ~Коротко из Telegram~ Mир распробовал умные очки, пишет Counterpoint. Рост продаж за первое… Архив рубрики ~Коротко из Telegram~ Увидели в «Ведомостях» интервью генерального директора Yandex Cloud Григория Атрепьева…. Архив рубрики ~Обо всем~ Луна в руках На выходных отраслевой блог NASA Watch опубликовал… Новости робототехники Роботы станут безопаснее: российский алгоритм снизил их аварийность в… Архив рубрики ~Коротко из Telegram~ НЕЙРОНКУ отправят в космос и оставят БЕЗ КОМАНД с Земли… Архив рубрики ~Коротко из Telegram~ Компаниям завезли УРОВНИ ИИ-зрелости — в день конференции «ГигаКонф-2026» Сбер… Архив рубрики ~Коротко из Telegram~ Selectel приобрёл 100% M1Cloud (ООО «Стек Групп»), сумма сделки составила… Архив рубрики ~Коротко из Telegram~ The Curricula AI — ИИ-платформа, которая помогает создавать персонализированные учебные… Архив рубрики ~Коротко из Telegram~ Dream Talk — открытый фреймворк, который создает выразительные видео с… Новости робототехники Оценка Toyota инвестиций в робототехнику в размере 6,4 млрд долларов ставит во главу угла физический искусственный интеллект. Архив рубрики ~Коротко из Telegram~ Исследовательница OpenAI выложила большой конспект по устройству LLM Исследовательница OpenAI… Архив рубрики ~Коротко из Telegram~ Агент прочитал вашу почту — и решил, что вам можно… Архив рубрики ~Коротко из Telegram~ Jina AI прокачала DeepSeek-OCR и ускорила разбор документов Модель рассчитана… Архив рубрики ~Коротко из Telegram~ Anthropic выкатила Claude Opus 5.5 — быстрее, дешевле и сильнее… Архив рубрики ~Коротко из Telegram~ Mир распробовал умные очки, пишет Counterpoint. Рост продаж за первое… Архив рубрики ~Коротко из Telegram~ Увидели в «Ведомостях» интервью генерального директора Yandex Cloud Григория Атрепьева…. Архив рубрики ~Обо всем~ Луна в руках На выходных отраслевой блог NASA Watch опубликовал… Новости робототехники Роботы станут безопаснее: российский алгоритм снизил их аварийность в… Архив рубрики ~Коротко из Telegram~ НЕЙРОНКУ отправят в космос и оставят БЕЗ КОМАНД с Земли… Архив рубрики ~Коротко из Telegram~ Компаниям завезли УРОВНИ ИИ-зрелости — в день конференции «ГигаКонф-2026» Сбер… Архив рубрики ~Коротко из Telegram~ Selectel приобрёл 100% M1Cloud (ООО «Стек Групп»), сумма сделки составила…

Оставить комментарий