Как экономить токены: 8 рабочих способовHow to save tokens: 8 practical methods
Каждый запрос включает вход, историю, правила проекта и ответ. Проверено ; рекомендации основаны на официальных руководствах по кэшированию и управлению контекстом.Every request includes input, history, project rules and output. Reviewed on ; guidance is based on official caching and context-management documentation.
OpenAI: Prompt caching · Anthropic: Prompt caching
Эконом-модель для черновиков
Черновики, переформулировки и простой код делайте моделью с низким коэффициентом; флагман оставьте для сложных решений.
Сравнить модели →Просите краткий ответ
Задайте формат и предел: пять пунктов, одна таблица, без повторного объяснения.
Новая тема — новый чат
Длинная посторонняя история отправляется снова и занимает контекст.
Сжимайте правила проекта
Оставляйте в AGENTS.md и правилах редактора только факты и обязательные ограничения.
Стабильное начало запроса
Повторяемые инструкции ставьте в начало, чтобы системы с поддержкой кэша могли переиспользовать этот блок.
Отключайте лишние инструменты
Описания инструментов и MCP могут входить в каждый запрос.
Проверяйте логи расхода
Сравнивайте модель, вход и выход, чтобы находить дорогие сценарии.
Открыть расход →Подбирайте модель под задачу
Один API-ключ позволяет менять модель без покупки новой подписки.