Claude Opus 4.8:告别“撒谎机”时代?
近日,Anthropic正式推出Claude Opus 4.8版本更新,重点针对模型“诚实性”进行优化。此前,大型语言模型在回答不确定问题时,常会生成看似合理但实际错误的信息,被用户戏称为“撒谎机”。新版通过强化事实核查机制与置信度校准,显著降低了模型虚构内容的倾向。
技术团队在训练中引入多轮对抗性测试,让模型学会在知识边界处主动表达不确定性,而非强行编造答案。早期测试显示,Opus 4.8在事实性任务中的错误率下降约40%,尤其在医疗、法律等高风险领域表现更为审慎。
此次更新延续了Anthropic对AI安全性的重视,开发者强调“诚实性”与“有用性”需同步提升。尽管完全杜绝幻觉仍是长期挑战,但该版本标志着实用型AI向更可靠方向迈出关键一步。