🤖 Компакцию чата в Claude Code отдали вероятностной модели Jev
Автор канала Tips AI протестировал плагин fast-jev-compaction (MIT, 1739 звёзд): вместо lossy-саммари от LLM Jev оценивает каждый tool_use и tool_result по двум типизированным вопросам и удаляет неактуальные вызовы, а сохранённое остаётся дословно.
🌍 Компакция контекста — дорогое место агентных систем: впервые вместо генерирующего LLM-саммари применён вероятностный классификатор, $0,042 за миллион входных токенов, дешевле, быстрее и без потери дословных сообщений.
👤 Плагин ставится сегодня: CLAUDE_CODE_ENABLE_FUNCTION_HOOKS=1 в ~/.claude/settings.json и установка из marketplace. Бесплатных $5 хватит на ~125 млн входных токенов, но сессии 150k+ придётся резать из-за лимита state в 32k. Доказательная база — единичный тест автора и документация вендора.
Источник 1: https://github.com/tamaratran/fast-jev-compaction Источник 2: https://docs.typesafe.ai/introduction
