RASC+:检索约束下大模型裁决提升临床术语集构建效果

arXiv·27 天前

临床价值集是医疗质量评估、表型分析、队列构建和临床决策支持中使用的标准化术语代码集合。传统直接使用大模型零样本生成的方法效果有限,因为临床代码系统规模庞大、版本复杂且难以被语言模型完整记忆。

最新研究提出RASC+两阶段框架:第一阶段采用检索增强策略优化候选池召回率,结合词汇感知扩展和代码显示救援检索技术,将候选池召回率从基准的0.553提升至0.730;第二阶段引入检索约束的大模型裁决机制,使用GPT-5对候选池进行盲审裁决。

实验结果显示,在3744个价值集的测试中,该方法将全测试集宏F1分数提升至0.549,在未见过发布者的数据分层上也达到0.533,显著优于传统交叉编码器方案。该方案在提升自动化构建效率的同时,严格遵守了所有返回代码必须来自可审计候选池的安全约束,为临床术语标准化工作提供了可靠的技术路径。

医疗AI大语言模型信息检索临床术语RASC

原文来源:https://arxiv.org/abs/2606.23992

相关阅读

AI_LectureNote:英语医学术语还原与语义保真度研究
大模型生成文本的“文学无风格”现象
大语言模型中的问题顺序效应:QQ等式审计揭示机制特性与饱和陷阱
首个吉尔吉斯语大模型基准发布:揭示低资源语言评估挑战
Scope3Trace:基于证据的Scope 3温室气体排放识别与提取框架

← 返回