Главная / Блог

Блог

Кэширование промптов для ИИ-агентов

Повторный выбор навыков в диалоге с ИИ-агентом снижает попадание в кэш промптов и незаметно увеличивает расходы.

Кэширование промптов для ИИ-агентов

Немного внутренней кухни

В Искре, нашей платформе с ИИ-агентами для компаний, у агентов есть шаг селекции навыка: определяется, какой из инструментов взять под текущий запрос, какую модель использовать и какого специалиста вызвать (уникальная фича Искры).

Внутри одного разговора этот выбор обычно (!) не меняется.

Но в проде шаг запускался заново на каждом ходу. Функционально всё работало: пользователь писал, агент отвечал, тесты были зелёные.
Заметно это было по одному показателю — попаданию в кэш промпта (доля запроса, которую модель переиспользует вместо пересчёта). Лишний служебный запрос менял начало контекста от хода к ходу, и кэш не срабатывал.

Расход рос понемногу на каждом ходу, поэтому не выглядел большой аномалией.

Руководитель Codex в OpenAI недавно перечислил похожие находки: служебная работа, которая незаметно повторяется на каждом обычном ходу.

Они починили, мы тоже починили. Всем пострадавшим сброшены лимиты.

Какой отсюда полезный совет?
Не знаю) просто поделился

#iskra #Codex #агенты

Этот пост впервые вышел в Telegram-канале @zvasilchannel 05 сен 2026. На сайте — для архива и поиска.
Открыть в Telegram →

КОНТАКТЫ

Обсудим ИИ-трансформацию вашей компании.

Напишите через форму на сайте или напрямую в Telegram. Быстро поймём, где ИИ может дать эффект, какой формат подойдёт руководителю или команде и с чего начать.

Менторская консультация

60 000 ₽

  • Диагностика процессов и задач под ИИ
  • Выбор первых внедрений с понятным эффектом
  • Подбор инструментов: Искра, модели, сервисы и автоматизации
  • План действий на 30 / 60 / 90 дней
Записаться