DeepSeek V4 的上下文窗口是 128K。窗口大不等于可以浪费——常驻 prompt 越长,缓存命中率越低,单次成本越高。我采用了双层压缩架构,核心原则是
主动压缩优先于被动溢出:
给 AI 编程代理做”减法”:Token 经济学视角下的配置工程实践
未经允许不得转载:小狮博客 » 给 AI 编程代理做”减法”:Token 经济学视角下的配置工程实践
DeepSeek V4 的上下文窗口是 128K。窗口大不等于可以浪费——常驻 prompt 越长,缓存命中率越低,单次成本越高。我采用了双层压缩架构,核心原则是
主动压缩优先于被动溢出: