让 AI Agent 读代码、跑命令,常像请人整理书桌:文件反复翻,终端输出整段塞进来,聊久了又忘记前情。LeanCTX 想把这些杂务统一接管。它是一个本地 Rust 二进制——编译好、可直接运行的程序——放在 Agent 与代码、终端、数据和模型之间,决定该读什么、记住什么,以及允许接触和发出什么。
它管理的核心是“上下文”,也就是模型一次能看到的全部材料。LeanCTX 提供多种文件读取模式,压缩命令输出,还可通过本地代理压缩系统提示、对话历史和工具结果;跨聊天保留会话记忆,并用实时面板和预算控制显示上下文花在哪里。项目作者举例称,重复读取约 2000 token 的文件,缓存后约需 13 token;约 800 token 的 git status 可压到约 120 token。token 是模型处理文字时使用的计量单位。
值得注意的不是又一种压缩工具,而是上下文治理开始被做成独立基础设施:它本地优先、可跨模型使用,试图把信息选择、长期记忆、权限边界和成本记录放进同一层。作者宣称可减少 60%—90% 的 token,但材料未提供独立验证结果。