AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
过程奖励模型
1 篇相关内容
相关话题
KV缓存
多智能体系统
计算优化
大语言模型
KV-PRM:通过KV缓存迁移实现高效过程奖励建模,加速多智能体测试时扩展
研究人员提出KV-PRM方法,通过直接读取LLM生成阶段产生的KV缓存,将过程奖励模型的评分计算复杂度从O(L²)降至O(L),在多智能体长序列任务中实现高达5000倍的计算效率提升。
a
arXiv
·
8 天前
过程奖励模型
KV缓存
多智能体系统
计算优化
a