AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
AI效率
4 篇相关内容
相关话题
推理优化
边缘计算
大语言模型
工具调用
评估指标
智能体
MoE模型
模型训练
语言模型
DASH方法
过度思考
模型压缩
新指标登场:如何科学衡量大模型工具调用效率?
研究人员提出“工具效率”与“边际工具效用”两项新指标,为评估大语言模型工具调用性能提供量化标准,助力构建更精简高效的工具套件。
a
arXiv
·
4 天前
大语言模型
工具调用
评估指标
智能体
a
StickyMoE:让专家模型“记住”路由路径,推理更省内存
研究人员提出StickyMoE训练方法,通过引入路由一致性损失函数,减少相邻token间专家切换频率,从而降低边缘设备推理时的内存交换开销,在保持模型性能的同时显著提升推理效率。
a
arXiv
·
8 天前
MoE模型
模型训练
推理优化
边缘计算
a
大模型“想太多”怎么办?新方法DASH让AI学会适时停止思考
研究团队发现语言模型在推理时经常“过度思考”,产生无益的自我反思。他们提出DASH方法,通过评估推理片段的价值来减少无效思考,在数学竞赛基准测试中显著提升准确率。
a
arXiv
·
19 天前
语言模型
推理优化
DASH方法
过度思考
a
TurboQuant:以极致压缩技术重塑AI效率,DeepMind算法新突破
Google DeepMind发布TurboQuant算法,通过极端压缩技术大幅提升AI模型运行效率,为边缘计算与低功耗场景带来突破性解决方案。
G
Google DeepMind
·
26 天前
模型压缩
算法优化
Google DeepMind
边缘计算
G