AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
AI研究
24 篇相关内容
相关话题
大语言模型
自然语言处理
世界模型
语言模型
开源模型
模型架构
具身智能
模型评估
推理能力
Google DeepMind
提示词工程
AGOPS
自动进化提示词指南:让AI更懂你的真实意图
研究人员提出AGOPS方法,能自动生成任务特定的提示词优化指南,帮助用户写出更明确的指令,显著提升大语言模型在数学推理、医疗问答等任务中的表现。
a
arXiv
·
3 天前
大语言模型
提示词工程
AGOPS
任务优化
a
UniSAGE:统一建模静态与动态属性的新型框架
研究者提出UniSAGE框架,通过构建全局属性图与正交参数子空间,实现静态属性与动态记录的统一建模,在多项任务中性能提升超10%。
a
arXiv
·
3 天前
模型框架
数据建模
静态动态属性
图神经网络
a
揭秘大语言模型的“倒计时”通用机制:同一子电路实现多任务计数
研究人员在Llama-3.1-70B-Instruct中发现了一个通用的“倒计时子电路”,该电路通过比较当前位置与目标长度来估计剩余时间,使模型能在多种任务中准确控制输出长度。
a
arXiv
·
5 天前
大语言模型
模型可解释性
Llama
逆向工程
a
语义导航大比拼:人类与三大主流大模型谁更灵活?
最新研究通过语言流畅性任务对比人类与GPT-4o等大模型的语义搜索模式,发现人类在概念空间中的探索更具多样性和广度,现有模型架构难以完全复现人类语义检索的动态平衡。
a
arXiv
·
5 天前
大语言模型
语义导航
认知科学
GPT-4o
a
MAGE研究揭示提示优化的稳定性与性能权衡:组件耦合效应是关键
研究人员通过MAGE框架发现提示优化中的组件耦合效应,表明多组件优化在提升性能的同时会放大方差,需同时评估性能与稳定性。
a
arXiv
·
5 天前
提示工程
大语言模型
优化算法
AI研究
a
突破时间限制:大规模点时间语言模型显著缩小性能差距
研究团队通过扩大模型规模至40亿参数,成功构建了消除未来信息泄露的点时间语言模型,在多项基准测试中接近主流开放权重模型的性能水平。
a
arXiv
·
5 天前
语言模型
时间序列
模型训练
开源模型
a
Anthropic 投入千万美元支持加拿大 AI 研究,培养下一代创新力量
AI 公司 Anthropic 宣布将向加拿大研究机构提供 1000 万美元资金,用于支持下一代人工智能研究项目。
A
Anthropic
·
6 天前
Anthropic
AI研究
资金支持
加拿大
A
混合模型策略:AfroXLMR-Social与DeBERTa在极化内容检测中的协同应用
研究人员提出一种混合建模方法,结合DeBERTa和AfroXLMR-Social模型,针对英语和豪萨语中的极化言论进行检测与分类,在资源受限环境下取得竞争性结果。
a
arXiv
·
6 天前
自然语言处理
社交媒体分析
多语言模型
内容审核
a
创造力新突破:无需数据即可提升大语言模型发散思维
研究人员提出CreativityNeuro方法,通过对比权重引导增强大语言模型创造力,在多项测试中显著提升模型原创性和减少模式崩溃现象。
a
arXiv
·
17 天前
大语言模型
创造力增强
权重引导
模式崩溃
a
Wiola架构发布:全新小语言模型设计,五大创新组件突破传统
研究人员提出完全原创的小语言模型架构Wiola,包含螺旋位置编码、跨层注意力等五大创新组件,已发布四个参数规模版本并兼容HuggingFace生态。
a
arXiv
·
17 天前
小语言模型
模型架构
自然语言处理
开源模型
a
世界模型结合因果推理,具身智能迈向新阶段
研究团队将世界模型与因果技术结合,为具身智能系统赋予更接近真实世界的推理与决策能力,标志着AI在理解与交互环境方面取得重要进展。
量
量子位
·
18 天前
世界模型
因果推理
具身智能
AI研究
量
语言模型为何“幻觉”?新研究揭示推理偏差根源
最新研究通过TrapQA测试框架发现,大语言模型的幻觉回答往往源于推理路径偏差而非知识缺失,揭示了预训练频率失衡如何导致模型忽略提示约束。
a
arXiv
·
18 天前
语言模型
幻觉问题
推理偏差
模型评估
a
Self-GC:让大模型智能体自主管理上下文,提升长任务处理效率
研究人员提出Self-GC框架,将智能体运行中的工具结果、文件、计划等转化为可索引对象,通过侧信道规划器动态管理上下文生命周期,在保持任务连续性的同时显著减少上下文长度。
a
arXiv
·
18 天前
大语言模型
智能体系统
上下文管理
AI研究
a
中国初创团队世界模型论文登顶Hugging Face,周鸿祎、陆奇共同投资
中国初创公司Loop发布的世界模型研究论文登上Hugging Face热门榜首,该研究探索AI如何通过反复推演理解世界运行规律,已获周鸿祎、陆奇等知名投资人青睐。
L
Loop
·
19 天前
世界模型
Loop
AI研究
Hugging Face
L
Janus控制器:为LLM记忆更新装上“选择开关”,防止知识污染
研究团队提出Janus插件控制器,可智能判断是否接受LLM记忆更新,避免新知识覆盖有用旧知识,在六个数据集上平均准确率提升2.7-4.6个百分点。
a
arXiv
·
19 天前
大语言模型
持续学习
记忆机制
模型优化
a
超越编译:自然语言到Lean形式化语句的忠实性评估新方法
研究团队提出新评估协议,揭示自然语言到Lean形式化过程中存在显著语义偏差,工具增强代理虽达89.5%编译率,但仅60.5%忠实度。
a
arXiv
·
19 天前
定理证明
形式化验证
Lean
语义评估
a
大模型思维表征四大公理:揭示基准测试掩盖的深层缺陷
研究者提出评估大模型潜在思维表征的四大公理框架,发现当前模型均无法同时满足所有公理要求,揭示基准测试精度掩盖的表征缺陷。
a
arXiv
·
21 天前
大语言模型
思维表征
评估框架
推理能力
a
新方法GILP:结合参数化世界模型,显著降低LLM智能体幻觉传播
研究提出GILP方法,通过结合小型参数化世界模型与LLM推理,将幻觉状态率从0.176降至0.035,显著提升智能体规划可靠性。
a
arXiv
·
21 天前
大语言模型
智能体规划
世界模型
幻觉控制
a
大模型推理优势揭秘:约束引导式推理是核心能力
研究发现,大语言模型在数学、物理、化学及编程等领域的推理任务中,相比小模型展现出稳定优势,其核心在于更强的约束引导式推理能力。
a
arXiv
·
24 天前
大语言模型
推理能力
约束推理
模型评估
a
推理解锁参数记忆:DeepMind揭示大语言模型知识提取新机制
Google DeepMind最新研究发现,推理过程能有效激活大语言模型的参数化知识,显著提升事实回忆准确性。
G
Google DeepMind
·
26 天前
大语言模型
知识提取
推理机制
Google DeepMind
G
DeepSeek-V4预览版正式开源,开启百万上下文高性价比时代
深度求索正式发布DeepSeek-V4预览版并开源,推出Pro和Flash两个版本,均支持百万上下文长度,性能媲美顶尖闭源模型。
D
DeepSeek 深度求索
·
27 天前
大模型
开源
DeepSeek
AI研究
D
Parcae:稳定循环模型,以更少参数实现更强性能
Together AI推出稳定循环语言模型Parcae,仅用770M参数即可达到1.3B Transformer模型性能,并首次提出循环扩展定律。
T
Together AI
·
27 天前
模型架构
参数效率
循环神经网络
性能优化
T
Google DeepMind 展望2026:I/O大会将开启AI驱动科学发现新纪元
Google DeepMind预告其2026年I/O大会将聚焦AI驱动的科学发现,标志着研究重心转向利用人工智能解决基础科学难题。
G
Google DeepMind
·
27 天前
快讯
Google DeepMind
AI研究
科学发现
AI for Science
G
何恺明团队新突破:仅258M参数实现高质量文生图,核心成员多为本科生
何恺明团队在arXiv发布最新研究成果,仅用258M参数模型即可实现高质量文本生成图像,团队六位作者中有五位为在读本科生。
a
arXiv
·
31 天前
文生图
轻量化模型
何恺明
计算机视觉
a