给 AI 编程代理做”减法”:Token 经济学视角下的配置工程实践

DeepSeek V4 的上下文窗口是 128K。窗口大不等于可以浪费——常驻 prompt 越长,缓存命中率越低,单次成本越高。我采用了双层压缩架构,核心原则是
主动压缩优先于被动溢出:

赞(0)
未经允许不得转载:小狮博客 » 给 AI 编程代理做”减法”:Token 经济学视角下的配置工程实践
分享到: 更多 (0)

联系我们