💻 Cursor сократил расход токенов агентов на 7%

Инженеры Cursor оптимизировали харнесс агента: системный промт ужат на 66%, статические описания инструментов — на 60% за счёт динамической подгрузки, cache breakpoints в API OpenAI (GPT-5.6) снизили холодные промахи кэша на 20%. Качество не пострадало.

🌍 Cursor показал механизм экономии: менять то, что харнесс отправляет в модель, а не просить модель быть бережливее — редкие инструменты выгружаются из статического контекста, кэш ставится после стабильных слоёв. Это напрямую улучшает юнит-экономику агентских продуктов.

👤 Собираете свой харнесс вокруг LLM: замерьте расходы по типам биллинга, вычистите защитные инструкции для старых моделей, оставьте статичными только read, search, edit, shell. Промт из Telegraph можно отдать агенту на рефакторинг.

Подробно: https://telegra.ph/Harness-token-efficiency-by-Cursor-09-24 Источник 1: https://cursor.com/blog/improved-token-efficiency