Переписываю системные промпты для Вашего бота, ассистента или агента - ответы становятся стабильнее, а счёт за API меньше.
Что делаю:
Разбор текущего промпта и логов - где модель уходит в сторону и на чём сгорают токены
Новый системный промпт - роль, границы, формат ответа, поведение на непонятном вопросе
Сжатие контекста - убираю дубли, длинные инструкции заменяю короткими правилами
Кэширование постоянной части промпта, чтобы не платить за неё в каждом запросе
Подбор модели под задачу - дешёвая на простое, сильная на сложное, маршрутизация между ними
Набор тестовых запросов и сверка ответов до правки и после
Расчёт стоимости одного запроса и месячного бюджета на Вашем объёме
Файл с промптами и пояснениями, чтобы дальше правили сами
Работаю с OpenClaw с самого запуска - там системный промпт удалось ужать с 25 тысяч токенов до 3-4 тысяч на запрос, качество ответов при этом не просело. Основная экономия обычно лежит в двух местах - раздутая история диалога и инструкции, которые дублируют друг друга по кругу.
Работаю с GPT, Claude, Gemini, DeepSeek и локальными моделями, через прямые API или OpenRouter.
5.000 - разбор, новый системный промпт и расчёт экономии по одному сценарию, срок 3 дня.
Пришлите текущий промпт и пару примеров плохих ответов - скажу, что тут можно вытянуть.