Как экономить токены: 8 рабочих способовHow to save tokens: 8 practical methods

Каждый запрос включает вход, историю, правила проекта и ответ. Проверено ; рекомендации основаны на официальных руководствах по кэшированию и управлению контекстом.Every request includes input, history, project rules and output. Reviewed on ; guidance is based on official caching and context-management documentation.

OpenAI: Prompt caching · Anthropic: Prompt caching

1

Эконом-модель для черновиков

Черновики, переформулировки и простой код делайте моделью с низким коэффициентом; флагман оставьте для сложных решений.

Сравнить модели →
2

Просите краткий ответ

Задайте формат и предел: пять пунктов, одна таблица, без повторного объяснения.

3

Новая тема — новый чат

Длинная посторонняя история отправляется снова и занимает контекст.

4

Сжимайте правила проекта

Оставляйте в AGENTS.md и правилах редактора только факты и обязательные ограничения.

5

Стабильное начало запроса

Повторяемые инструкции ставьте в начало, чтобы системы с поддержкой кэша могли переиспользовать этот блок.

6

Отключайте лишние инструменты

Описания инструментов и MCP могут входить в каждый запрос.

7

Проверяйте логи расхода

Сравнивайте модель, вход и выход, чтобы находить дорогие сценарии.

Открыть расход →
8

Подбирайте модель под задачу

Один API-ключ позволяет менять модель без покупки новой подписки.

Нужны готовые навыки для агентов?Need ready-made agent skills?

Открыть каталог навыковOpen the skills catalog