AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
知识蒸馏
5 篇相关内容
相关话题
模型优化
大语言模型
LLaMA 3
RAG
检索增强生成
大型语言模型
模型压缩
交互分析
机器学习
实体匹配
数据标注
模型训练
LLaMA 3变身高效重排器:知识蒸馏助力RAG性能提升
研究团队通过知识蒸馏技术,将LLaMA 3 8B模型转化为高效的重排器,在RAG系统中实现显著性能提升的同时大幅降低推理成本。
a
arXiv
·
6 天前
LLaMA 3
RAG
知识蒸馏
模型优化
a
新研究揭示大模型知识蒸馏通用机制:稀疏化交互是关键
研究团队通过交互分解方法,统一解释了知识蒸馏在大型语言模型中的有效机制,并提出一种新的损失函数以提升蒸馏性能。
a
arXiv
·
8 天前
知识蒸馏
大型语言模型
模型压缩
交互分析
a
大模型当老师,小模型做学生:知识蒸馏助力实体匹配数据标注
研究提出利用大语言模型作为“教师”自动标注训练数据,再训练轻量级“学生”模型的方法,在保持高准确率的同时大幅降低实体匹配任务的数据标注成本与推理延迟。
a
arXiv
·
21 天前
大语言模型
知识蒸馏
实体匹配
数据标注
a
ATOD:多轮自主智能体训练新方法,融合蒸馏与强化学习优势
研究者提出ATOD混合训练算法,通过退火调度机制结合策略蒸馏与强化学习,显著提升小模型智能体在长程交互任务中的性能表现。
a
arXiv
·
22 天前
模型训练
强化学习
知识蒸馏
自主智能体
a
超越轨迹模仿:策略引导优化提升大模型推理能力
研究者提出策略引导策略优化方法,通过提炼可复用的推理策略而非单纯模仿解题步骤,显著提升语言模型的泛化推理能力。
a
arXiv
·
27 天前
大语言模型
推理优化
知识蒸馏
策略学习
a