这套设计的核心判断很明确:技能系统不能像传统插件市场一样,把所有内容预先索引、预先展开、预先注入。Agent 会话里的
上下文窗口太贵,技能越多,越不能一次性把所有细节暴露给模型。Hermes 选择了一条更朴素的路:
运行时扫描,分层披露,只有在真正用到某个技能时才付出更多 token。

Hermes Skill Runtime 架构拆解:三层加载如何压住 Agent 上下文成本
相关推荐
- OpenVLA 核心原理深度解析
- Excelize 开源十周年,发布 2.11.0 版本
- 代码审查 Agent Harness 实战:AI 自动 Code Review
- .NET 10 File-Based Apps:一个 .cs 文件搞定一切,C# 终于也能像 Python 一样写脚本了!
- Extension storage、Interest groups 和 Shared storage 简介-浏览器缓存之【隐私沙盒与扩展专用存储】
- 新手学 Skills:是什么、怎么找、如何开发?(最通俗易懂版)
- 零基础认识大语言模型(LLM)工作原理(8.为什么大模型会“胡说八道”?)
- 业务智能体实战笔记:分层消除不确定性(一)|总纲:把不确定性从 LLM 侧转移到工程侧
小狮博客