AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
模型加速
3 篇相关内容
相关话题
大语言模型
扩散模型
缓存优化
混合精度
Gemini Nano
Google DeepMind
移动AI
多令牌预测
PyTorch
性能优化
机器学习框架
计算图
LaCache框架:为扩散大语言模型实现无损缓存与自适应精度推理
研究人员提出LaCache训练免费加速框架,通过无损缓存和混合精度技术,显著减少扩散大语言模型在文本生成中的计算冗余,实现最高40.2倍端到端加速。
a
arXiv
·
5 小时前
大语言模型
模型加速
扩散模型
缓存优化
a
谷歌 Pixel 手机搭载 Gemini Nano 模型,多令牌预测技术加速推理性能
Google DeepMind 宣布在 Pixel 手机上加速 Gemini Nano 模型,通过冻结多令牌预测技术提升推理效率,优化移动端 AI 体验。
G
Google DeepMind
·
24 天前
Gemini Nano
Google DeepMind
移动AI
模型加速
G
PyTorch性能剖析进阶:从nn.Linear到融合MLP的优化之路
PyTorch官方发布性能剖析系列第二篇,深入探讨如何通过融合多层感知机(MLP)中的线性层与激活函数,显著提升模型运行效率。
H
Hugging Face
·
27 天前
PyTorch
性能优化
机器学习框架
模型加速
H