AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
混合精度
1 篇相关内容
相关话题
大语言模型
模型加速
扩散模型
缓存优化
LaCache框架:为扩散大语言模型实现无损缓存与自适应精度推理
研究人员提出LaCache训练免费加速框架,通过无损缓存和混合精度技术,显著减少扩散大语言模型在文本生成中的计算冗余,实现最高40.2倍端到端加速。
a
arXiv
·
10 小时前
大语言模型
模型加速
扩散模型
缓存优化
a