AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
RAG
10 篇相关内容
相关话题
大语言模型
知识图谱
arXiv
企业AI
检索增强
数据湖
问答系统
基准测试
智能体
LLaMA 3
知识蒸馏
模型优化
HG-RAG:基于层级知识图谱的检索增强生成新框架
研究者提出HG-RAG框架,通过层次化知识图谱检索增强大模型推理能力,在关系推理和多跳查询任务中显著优于传统平面检索方法。
a
arXiv
·
4 天前
RAG
知识图谱
大语言模型
检索增强
a
LakeQuest基准:三大领域数据湖问答系统面临真实挑战
研究人员推出LakeQuest基准测试,包含近万个人工验证的问答对,覆盖AI/ML、零售银行和生物医学三大领域,揭示现代问答系统在真实数据湖环境中的关键缺陷。
a
arXiv
·
6 天前
数据湖
问答系统
基准测试
RAG
a
LLaMA 3变身高效重排器:知识蒸馏助力RAG性能提升
研究团队通过知识蒸馏技术,将LLaMA 3 8B模型转化为高效的重排器,在RAG系统中实现显著性能提升的同时大幅降低推理成本。
a
arXiv
·
6 天前
LLaMA 3
RAG
知识蒸馏
模型优化
a
企业RAG系统成本治理新方案:实现多租户检索与生成统一计费
研究人员提出Cost-Governed RAG架构,通过结合TurboVec向量索引与多租户LLM治理网关,首次实现检索层与生成层的统一成本追溯,解决企业RAG部署中的成本分摊难题。
a
arXiv
·
6 天前
RAG
成本治理
多租户系统
向量数据库
a
大语言模型赋能基本面分析:基于RAG的投资者简报生成系统
研究者利用GPT-4o构建RAG系统,通过处理公司财报和宏观经济数据,自动生成投资简报。九位个人投资者参与评估,验证了该方法的实用性。
a
arXiv
·
8 天前
大语言模型
金融科技
RAG
基本面分析
a
CORTEX:基于内部表征对比的RAG幻觉检测新方法
研究人员提出CORTEX方法,通过对比大模型在有/无检索文档时的内部表征,实现细粒度的token级幻觉检测,在多个基准测试中表现优异。
a
arXiv
·
20 天前
RAG
幻觉检测
大语言模型
可信AI
a
多模态知识图谱增强生成迎来专用评测基准:MKG-RAG-Bench
研究者推出首个专注于多模态知识图谱检索增强生成(MKG-RAG)中检索环节的跨领域评测基准MKG-RAG-Bench,通过实验证明有效检索仍是提升系统性能的关键瓶颈。
a
arXiv
·
25 天前
知识图谱
RAG
多模态检索
评测基准
a
Gemini企业级代理平台发布Agentic RAG,解锁可靠AI响应
Google DeepMind推出Gemini企业级代理平台的Agentic RAG功能,旨在通过增强的数据管理能力提升AI响应的可靠性和准确性。
G
Google DeepMind
·
26 天前
大模型
Google
企业AI
数据管理
G
通义千问推出Qwen3 Embedding系列,专攻文本嵌入与重排序任务
通义千问基于Qwen3基础模型发布全新文本嵌入与重排序专用模型系列,在多语言理解与检索任务中实现领先性能。
通
通义千问 Qwen
·
28 天前
通义千问
文本嵌入
检索模型
开源模型
通
CacheWeaver:让RAG推理更高效的新方法,可降低首词延迟20-33%
研究人员提出CacheWeaver方法,通过智能排序检索证据来提升RAG推理效率,在保持答案质量的同时将首词生成时间降低约20-33%。
a
arXiv
·
31 天前
RAG
推理优化
缓存技术
大语言模型
a