AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
模型优化
14 篇相关内容
相关话题
大语言模型
检索增强生成
小语言模型
知识蒸馏
自然语言处理
边缘计算
上下文剪枝
合作博弈论
沙普利值
知识图谱
神经符号AI
推理增强
Shapley上下文剪枝:基于合作博弈论的RAG系统优化新框架
研究人员提出Shapley上下文剪枝框架,首次将合作博弈论引入检索增强生成系统,为上下文重排序与剪枝提供可解释的数学基础,在多项评测中展现竞争力。
a
arXiv
·
5 小时前
检索增强生成
上下文剪枝
合作博弈论
沙普利值
a
知识图谱加持:小语言模型推理能力提升新路径
研究团队提出一种神经符号智能体框架,通过知识图谱工具增强Gemma 3、Llama 3.2等小语言模型的多跳逻辑推理能力,在亲属关系基准测试中实现1.5-2倍性能提升。
a
arXiv
·
4 天前
小语言模型
知识图谱
神经符号AI
推理增强
a
LLaMA 3变身高效重排器:知识蒸馏助力RAG性能提升
研究团队通过知识蒸馏技术,将LLaMA 3 8B模型转化为高效的重排器,在RAG系统中实现显著性能提升的同时大幅降低推理成本。
a
arXiv
·
6 天前
LLaMA 3
RAG
知识蒸馏
模型优化
a
本地字幕翻译新突破:专用词表优化实现移动端实时英翻中
研究人员针对台湾地区英译中字幕场景,通过构建专用词表与模型适配,在保持隐私的前提下实现移动端低延迟实时翻译,性能超越谷歌翻译基准。
a
arXiv
·
7 天前
本地AI
实时翻译
模型优化
移动计算
a
B站开源Index-1.9B小语言模型系列,1.9B参数性能媲美数倍规模竞品
Bilibili发布Index-1.9B系列开源小语言模型,包含基础版、纯净版、对话版和角色版四种变体。该系列模型在多项标准基准测试中表现出色,1.9B参数规模即可达到与数倍规模开源模型相当甚至更优的性能。
B
Bilibili
·
7 天前
小语言模型
Bilibili
开源模型
中文NLP
B
词汇表移植技术:解决孟加拉语轻量语音识别中的自回归崩溃问题
研究提出一种创新的词汇表移植方法,通过替换解码器词汇表为原生孟加拉语词汇,显著降低轻量语音识别模型在非拉丁语系语言上的自回归崩溃风险。
a
arXiv
·
8 天前
语音识别
边缘计算
多语言处理
自然语言处理
a
自引导测试时训练:提升大模型长文本理解能力的新方法
研究人员提出自引导测试时训练方法,通过智能筛选关键证据片段进行参数微调,显著提升大模型在长文本任务中的推理准确率。
a
arXiv
·
8 天前
大语言模型
长文本处理
测试时训练
模型优化
a
参数高尔夫挑战赛:哪些优化技术真正有效?
一项名为'参数高尔夫'的社区挑战赛探索了在严格资源限制下语言模型的优化极限,通过分析两千多个提交方案,揭示了84种优化技术的实际效果。
a
arXiv
·
18 天前
语言模型
模型优化
参数压缩
社区挑战
a
Janus控制器:为LLM记忆更新装上“选择开关”,防止知识污染
研究团队提出Janus插件控制器,可智能判断是否接受LLM记忆更新,避免新知识覆盖有用旧知识,在六个数据集上平均准确率提升2.7-4.6个百分点。
a
arXiv
·
20 天前
大语言模型
持续学习
记忆机制
模型优化
a
大模型当老师,小模型做学生:知识蒸馏助力实体匹配数据标注
研究提出利用大语言模型作为“教师”自动标注训练数据,再训练轻量级“学生”模型的方法,在保持高准确率的同时大幅降低实体匹配任务的数据标注成本与推理延迟。
a
arXiv
·
21 天前
大语言模型
知识蒸馏
实体匹配
数据标注
a
英伟达开源MoE优化工具:Transformers v5集成专家并行,微调速度提升3.7倍
英伟达开源MoE(混合专家)优化工具,通过集成专家并行、DeepEP和TransformerEngine技术,显著提升大模型微调效率。
英
英伟达
·
25 天前
MoE
英伟达
模型优化
开源工具
英
Sipp:浏览器内运行本地小模型,速度提升三倍
开源项目Sipp让用户能在浏览器中直接运行小型本地语言模型,速度比传统方式快三倍。
S
Sipp
·
26 天前
本地推理
浏览器AI
开源项目
边缘计算
S
Together AI 推出分布感知推测解码,RL训练后推理速度提升50%
Together AI发布分布感知推测解码技术,针对强化学习训练后的推理瓶颈,可实现高达50%的加速且保持奖励质量无损。
T
Together AI
·
27 天前
推理加速
推测解码
强化学习
Together AI
T
Claude Opus 4.8:告别“撒谎机”时代?
Anthropic发布Claude Opus 4.8版本,显著提升模型诚实度与可靠性,减少虚构信息生成。
A
Anthropic
·
31 天前
Claude
Anthropic
大语言模型
AI安全
A