小狮博客
联系我们
联系我们
当前位置:
小狮博客
>
技术专栏
>
正文
LLM 场景下的强化学习技术扫盲
2025-12-12
分类:
技术专栏
阅读(448)
评论(0)
为了做到这一点,我们需要一套语言来描述这个过程。下面我们以 LLM 场景为基础介绍几个 RL 的“行业黑话”。
赞(
0
)
未经允许不得转载:
小狮博客
»
LLM 场景下的强化学习技术扫盲
分享到:
更多
(
0
)
上一篇
RFSOC学习记录(五)带通采样定理
下一篇
算法分析–基数排序
相关推荐
天数智芯–天垓150S 华为泰山鲲鹏服务器实测
Zabbix监控实战–正则表达式的使用
一套替代四套!同程旅行用 Apache SeaTunnel 搭建多模态统一数据通道
ansible roles详解
Agent 从上手到精通:打造有记忆的个人智能体
深入 RocketMQ 内核:事务消息——分布式事务的终极解法(四)
用 Solon ReActAgent 落地发票识别与智能报销
Agent 小知识|上下文预算:让 Agent 知道该看什么
联系我们
回顶
回顶部