TokenPilot:让 LLM Agent 长会话成本降 60%+ 的上下文管理

这篇论文讨论的是 Agent 长任务里的上下文管理:当历史内容不断累积时,系统如何在减少冗余 token 的同时,尽量维持 prompt cache 的稳定命中。

赞(0)
未经允许不得转载:小狮博客 » TokenPilot:让 LLM Agent 长会话成本降 60%+ 的上下文管理
分享到: 更多 (0)

联系我们