Claude Opus 4.8:告别“撒谎机”时代?

Anthropic·31 天前

近日,Anthropic正式推出Claude Opus 4.8版本更新,重点针对模型“诚实性”进行优化。此前,大型语言模型在回答不确定问题时,常会生成看似合理但实际错误的信息,被用户戏称为“撒谎机”。新版通过强化事实核查机制与置信度校准,显著降低了模型虚构内容的倾向。

技术团队在训练中引入多轮对抗性测试,让模型学会在知识边界处主动表达不确定性,而非强行编造答案。早期测试显示,Opus 4.8在事实性任务中的错误率下降约40%,尤其在医疗、法律等高风险领域表现更为审慎。

此次更新延续了Anthropic对AI安全性的重视,开发者强调“诚实性”与“有用性”需同步提升。尽管完全杜绝幻觉仍是长期挑战,但该版本标志着实用型AI向更可靠方向迈出关键一步。

ClaudeAnthropic大语言模型AI安全模型优化

原文来源:https://www.youtube.com/watch?v=ypL7kUiw_LM

相关阅读

Anthropic启动罕见病AI科研资助计划,最高提供5万美元Claude使用额度
Anthropic推出教师专用版Claude,助力教育领域AI应用
加拿大如何应用Claude:AI安全公司的实践探索
Anthropic 投入千万美元支持加拿大 AI 研究,培养下一代创新力量
Claude价值观研究:模型与语言如何影响AI表达倾向

← 返回