AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
MLLM
1 篇相关内容
相关话题
多模态大模型
模型评测
人工智能评估
arXiv研究
多模态大模型评测存在哪些盲区?研究者系统梳理关键缺失维度
最新研究指出,当前多模态大语言模型的评测体系存在明显滞后,多数基准测试局限于孤立任务,难以评估模型跨模态信息整合能力。
a
arXiv
·
25 天前
多模态大模型
模型评测
人工智能评估
arXiv研究
a