LLM代理
2 条- 01代理编辑世界模型:为大语言模型代理重新思考世界建模
提出Agent-Editing World Model,聚焦预测执行依赖型工具响应而非环境观测,缓解任务状态污染问题。
- 02内在路由器:从冻结的大型语言模型中激发原生技能路由能力
证明冻结LLM前向传播中已隐含技能路由信号,仅需两个线性映射即可提取,摆脱元数据上下文依赖与检索外挂。
提出Agent-Editing World Model,聚焦预测执行依赖型工具响应而非环境观测,缓解任务状态污染问题。
证明冻结LLM前向传播中已隐含技能路由信号,仅需两个线性映射即可提取,摆脱元数据上下文依赖与检索外挂。