AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
多项选择题问答
1 篇相关内容
相关话题
大语言模型
提示工程
模型评估
基准测试
提示工程“简单”反而更强?研究揭示LLM评估中的“简洁性悖论”
一项大规模实证研究发现,在多项选择题问答任务中,简单的基线提示法往往优于复杂的推理提示技术,挑战了“越复杂越好”的普遍假设。
a
arXiv
·
4 天前
大语言模型
提示工程
模型评估
多项选择题问答
a