AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
开源模型
33 篇相关内容
相关话题
通义千问
大语言模型
大模型
Mistral AI
NVIDIA
智能体
DeepSeek
月之暗面
长上下文
AI研究
可信AI
小语言模型
面壁智能开源1.5B参数VLA模型,跻身具身智能前沿阵营
面壁智能近日开源了MiniCPM-Robot系列模型,这是一个参数规模为15亿的通用视觉语言动作模型,在具身智能领域展现出强劲竞争力。
面
面壁智能
·
20 小时前
具身智能
开源模型
视觉语言动作模型
面壁智能
面
月之暗面发布Kimi K3:2.8万亿参数、百万上下文原生多模态大模型
月之暗面正式发布Kimi K3大模型,具备2.8万亿参数、百万上下文窗口及原生多模态能力,并宣布将于2026年7月27日前开源模型权重。
月
月之暗面 Kimi
·
4 天前
大模型
月之暗面
开源模型
多模态AI
月
突破时间限制:大规模点时间语言模型显著缩小性能差距
研究团队通过扩大模型规模至40亿参数,成功构建了消除未来信息泄露的点时间语言模型,在多项基准测试中接近主流开放权重模型的性能水平。
a
arXiv
·
5 天前
语言模型
时间序列
模型训练
开源模型
a
Nemotron Labs:开源模型如何让企业与国家拥有可信、可控、可定制的AI
NVIDIA旗下Nemotron Labs强调,企业选择AI模型的关键在于能否真正满足业务需求,通过开源模型实现可信、可控与深度定制。
N
NVIDIA AI
·
6 天前
开源模型
企业AI
NVIDIA
AI定制化
N
B站开源Index-1.9B小语言模型系列,1.9B参数性能媲美数倍规模竞品
Bilibili发布Index-1.9B系列开源小语言模型,包含基础版、纯净版、对话版和角色版四种变体。该系列模型在多项标准基准测试中表现出色,1.9B参数规模即可达到与数倍规模开源模型相当甚至更优的性能。
B
Bilibili
·
6 天前
小语言模型
Bilibili
开源模型
中文NLP
B
Wiola架构发布:全新小语言模型设计,五大创新组件突破传统
研究人员提出完全原创的小语言模型架构Wiola,包含螺旋位置编码、跨层注意力等五大创新组件,已发布四个参数规模版本并兼容HuggingFace生态。
a
arXiv
·
17 天前
小语言模型
模型架构
自然语言处理
开源模型
a
Palantir联手NVIDIA推出政府专用AI平台,采用开源模型保障安全
Palantir推出基于NVIDIA Nemotron开源模型的智能引擎,为美国政府机构提供安全可控的AI服务,彰显开源创新在美国人工智能发展中的关键作用。
N
NVIDIA AI
·
21 天前
开源模型
政府AI
NVIDIA
Palantir
N
Hugging Face模型榜单现黑马:yuxinlu1个人模型跻身前列
Hugging Face模型排行榜出现新变化,个人开发者yuxinlu1的模型表现突出,在一众大厂模型中跻身前列,引发社区关注。
H
Hugging Face
·
22 天前
Hugging Face
开源模型
模型评测
社区
H
维基百科小编辑如何影响大模型价值观?动物权益倡导者案例揭秘
研究发现,维基百科编辑志愿者通过系统性地添加动物福利内容,能显著影响大语言模型在该议题上的输出倾向,即使编辑量仅涉及百余个页面。
a
arXiv
·
25 天前
大语言模型
维基百科
数据偏见
AI伦理
a
智谱发布GLM-5.2大模型:开源权重、百万上下文,专攻编程与智能体任务
智谱AI正式推出GLM-5.2系列大模型,在编程与智能体任务上实现显著提升,并开放MIT许可的模型权重。该系列提供两种推理级别,其中GLM-5.2(max)追求性能极限,GLM-5.2(high)则在性能与token效率间取得平衡。
智
智谱 GLM
·
26 天前
智谱GLM
大模型
开源模型
编程增强
智
Kimi K2.6 登顶金融智能体评测榜,开源模型表现亮眼
月之暗面旗下智能助手 Kimi 的最新版本 K2.6,在最新的金融智能体基准评测 V2 中,位列开源模型榜首。
月
月之暗面 Kimi
·
27 天前
快讯
Kimi
月之暗面
大模型
金融科技
月
Kimi K2.7 Code 推出高速模式,推理速度提升高达6倍
月之暗面为其开源多模态编程模型 Kimi K2.7 Code 推出高速模式,在编程任务中可实现最高6倍的速度提升,现已面向测试计划成员、API开发者及商业用户逐步开放。
月
月之暗面 Kimi
·
27 天前
快讯
Kimi
代码生成模型
开源模型
推理加速
月
DeepSeek开源FlashMLA解码内核,专为Hopper GPU优化
DeepSeek在开源周首日发布FlashMLA解码内核,该内核针对Hopper GPU的变长序列解码进行了优化,现已投入生产环境。
D
DeepSeek 深度求索
·
27 天前
快讯
解码优化
GPU加速
开源模型
推理部署
D
DeepSeek-V3-0324正式发布:推理能力大幅提升,前端开发技能增强
DeepSeek最新模型V3-0324正式推出,在推理性能、前端开发能力和工具使用智能方面均有显著提升。
D
DeepSeek 深度求索
·
27 天前
快讯
DeepSeek
大语言模型
开源模型
AI开发工具
D
DeepSeek-R1-0528正式发布:推理能力全面升级,幻觉显著减少
深度求索公司推出DeepSeek-R1-0528版本,在基准测试、前端能力、幻觉控制等方面均有显著提升,并新增JSON输出和函数调用支持。
D
DeepSeek 深度求索
·
27 天前
快讯
DeepSeek
大语言模型
模型更新
开源模型
D
Together AI 首发上线 NVIDIA Nemotron 3 Nano Omni:全能多模态推理模型
Together AI 在发布首日即上线 NVIDIA Nemotron 3 Nano Omni 模型,这是一个面向大规模智能体工作负载设计的统一开源模型,可跨视频、图像、音频和文本进行推理。
T
Together AI
·
27 天前
多模态模型
NVIDIA
Together AI
开源模型
T
Together AI与Adaption达成合作:原生集成微调工具至数据平台
Together AI宣布与Adaption建立合作伙伴关系,将Together Fine-Tuning原生集成至Adaptive Data平台,助力团队优化数据集、运行微调、评估结果并部署更强大的开源模型。
T
Together AI
·
27 天前
快讯
模型微调
Together AI
AI工具链
开源模型
T
JetBrains发布Mellum2:120亿参数MoE模型,专为代码生成优化
知名开发工具厂商JetBrains推出其首个开源大模型Mellum2,采用混合专家架构,专注于代码生成与编程辅助任务。
H
Hugging Face
·
27 天前
大模型
代码生成
开源模型
JetBrains
H
开源模型工具调用能力大考:你的Agent够“智能体”吗?
Hugging Face发布新基准测试,帮助开发者评估开源模型在自定义工具调用与智能体任务中的实际表现。
H
Hugging Face
·
27 天前
开源模型
智能体
基准测试
工具调用
H
通义千问Qwen2.5正式发布,开源阵容再创新高
阿里云通义千问团队推出Qwen2.5系列模型,号称可能是史上最大规模的开源模型发布,在智能与知识能力上实现显著提升。
通
通义千问 Qwen
·
28 天前
通义千问
大语言模型
开源模型
Qwen2.5
通
通义千问开源Qwen2.5-Coder系列:32B版本媲美GPT-4o,覆盖多尺寸与编程语言
阿里通义千问开源Qwen2.5-Coder系列代码大模型,其中32B版本在编程能力上达到开源SOTA水平,可匹配GPT-4o,并推出从1.5B到32B的多样化尺寸矩阵。
通
通义千问 Qwen
·
28 天前
代码大模型
通义千问
开源模型
编程AI
通
通义千问发布视觉增强大模型QVQ,探索语言与视觉融合新路径
通义千问团队提出QVQ模型,尝试将视觉理解能力融入大语言模型,以提升AI的认知与推理能力。该模型已在多个开源平台发布。
通
通义千问 Qwen
·
28 天前
通义千问
多模态大模型
视觉语言模型
AI推理
通
通义千问发布Qwen2.5-VL多模态模型,视觉理解能力大幅提升
阿里云通义千问团队正式推出新一代视觉语言模型Qwen2.5-VL,在视觉理解能力上实现显著突破,提供3B、7B、72B三种规格的开源版本。
通
通义千问 Qwen
·
28 天前
通义千问
多模态模型
视觉语言模型
开源模型
通
通义千问开源Qwen2.5-1M模型:支持百万token上下文,可自部署
继Qwen2.5-Turbo后,通义千问开源两款支持百万token上下文的模型Qwen2.5-7B/14B-Instruct-1M,并同步发布推理框架支持。
通
通义千问 Qwen
·
28 天前
通义千问
大语言模型
开源模型
长上下文
通
通义千问推出Qwen3 Embedding系列,专攻文本嵌入与重排序任务
通义千问基于Qwen3基础模型发布全新文本嵌入与重排序专用模型系列,在多语言理解与检索任务中实现领先性能。
通
通义千问 Qwen
·
28 天前
通义千问
文本嵌入
检索模型
开源模型
通
通义千问发布Qwen3-Coder:专为智能体编程设计的新一代代码模型
通义千问团队正式推出Qwen3-Coder系列代码模型,其中旗舰版本Qwen3-Coder-480B-A35B-Instruct在智能体编程、浏览器操作及工具使用等任务上达到开源模型新高度。
通
通义千问 Qwen
·
28 天前
通义千问
代码模型
AI编程
智能体
通
Mistral AI正式推出AI Studio平台,开发者可一键部署定制模型
欧洲AI公司Mistral AI推出云端AI模型开发平台Mistral AI Studio,支持开发者通过API快速调用、微调并部署其开源模型。
M
Mistral AI
·
28 天前
Mistral AI
AI开发平台
模型部署
开源模型
M
Mistral AI 发布 Mistral 3 模型
Mistral AI 正式推出新一代模型 Mistral 3,在推理效率与多语言能力上实现显著提升。
M
Mistral AI
·
28 天前
Mistral AI
大模型
开源模型
多语言AI
M
Mistral AI 推出开源基础模型 Leanstral,专注可信赖的直觉式编程
Mistral AI 正式发布开源基础模型 Leanstral,旨在为开发者提供更可信赖的直觉式编程(vibe-coding)支持。
M
Mistral AI
·
28 天前
开源模型
代码生成
Mistral AI
AI编程
M
Mistral AI 与 NVIDIA 达成合作,共同加速开源前沿模型发展
法国 AI 公司 Mistral AI 宣布与 NVIDIA 建立合作伙伴关系,旨在利用 NVIDIA 的先进计算平台加速其开源前沿模型的研发与部署。
M
Mistral AI
·
28 天前
Mistral AI
NVIDIA
开源模型
AI 合作
M
Mistral AI发布开源语音模型Voxtral TTS,为语音智能体带来自然语音生成
Mistral AI推出前沿开源语音合成模型Voxtral TTS,该模型具备快速生成、即时适配能力,可为语音智能体提供逼真的人声输出。
M
Mistral AI
·
28 天前
语音合成
开源模型
Mistral AI
语音智能体
M
清华开源空间模型亮相ECCV 2026,在动态环境中展现持续学习能力
清华大学团队开源的空间智能模型入选ECCV 2026,该模型在动态环境理解任务中表现优异,展现出持续学习的世界交互能力。
清
清华大学
·
28 天前
空间智能
持续学习
计算机视觉
开源模型
清
DeepSeek-V4预览版发布:支持百万令牌上下文的高效MoE模型
深度求索推出DeepSeek-V4系列预览版,包含两款混合专家模型,均支持百万令牌上下文,在长文本处理效率上实现显著突破。
D
DeepSeek 深度求索
·
31 天前
DeepSeek
大语言模型
混合专家
长上下文
D