AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
临床决策
4 篇相关内容
相关话题
医疗AI
大语言模型
时序数据
问答系统
评测基准
多模态学习
癌症预测
基准测试
电子病历
强化学习
FHIR标准
模型训练
CLIR-Bench:首个专为不规则临床时序数据问答设计的评测基准
研究者发布CLIR-Bench基准,专门评估AI模型在稀疏、不规则采样的临床时间序列数据上进行问答推理的能力,填补了现有医学AI评测的空白。
a
arXiv
·
7 天前
医疗AI
时序数据
问答系统
评测基准
a
SAGEAgent:让AI智能决策癌症诊断流程,减少55%检查负担
研究者提出基于大语言模型的临床智能体SAGEAgent,能根据患者情况动态选择必要的诊断检查项目,在保证生存预测准确性的同时,显著降低临床检查负担。
a
arXiv
·
8 天前
医疗AI
多模态学习
大语言模型
临床决策
a
医疗AI新基准:LongMedBench评估大模型长期临床决策能力
研究者推出首个基于真实电子病历的长期临床决策基准LongMedBench,填补了现有评估在长时程医疗场景中的空白。该基准通过整合患者多次就诊记录,系统评估AI医疗代理在事实问答、时序推理和长期决策三方面的表现。
a
arXiv
·
8 天前
医疗AI
临床决策
基准测试
大语言模型
a
医疗AI代理的临床反馈困境:RL在FHIR环境中的诊断与突破
研究发现,在临床FHIR环境中应用强化学习面临两大结构障碍:能力天花板与格式知识壁垒,导致纯RL效果显著落后于规则微调。
a
arXiv
·
18 天前
医疗AI
强化学习
FHIR标准
临床决策
a