AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
工具调用
5 篇相关内容
相关话题
智能体
大语言模型
评估指标
AI效率
AI安全
LLM智能体
安全框架
上下文感知
强化学习
企业API
Qwen模型
工作流自动化
新指标登场:如何科学衡量大模型工具调用效率?
研究人员提出“工具效率”与“边际工具效用”两项新指标,为评估大语言模型工具调用性能提供量化标准,助力构建更精简高效的工具套件。
a
arXiv
·
4 天前
大语言模型
工具调用
评估指标
智能体
a
Safety Sentry:为AI智能体引入上下文感知的三路安全路由机制
研究团队提出Safety Sentry框架,将传统二元安全判断扩展为“执行-询问-拒绝”三路决策,通过单次解码调用实现轻量级安全防护,显著提升LLM智能体工具调用的安全性。
a
arXiv
·
5 天前
AI安全
LLM智能体
工具调用
安全框架
a
超越下一词预测:RLVR方法在Atlassian工具调用智能体上的概念验证
研究团队提出RLVR方法,通过强化学习与可验证奖励机制,显著提升小型语言模型在企业API工作流中的工具调用准确率,在Jira和Confluence模拟环境中实现从0.35到接近1.00的性能跃升。
a
arXiv
·
18 天前
强化学习
工具调用
企业API
Qwen模型
a
智谱GLM-5.1修复工具调用Bug,更新对话模板
智谱AI发布公告,针对使用vLLM/SGLang框架运行GLM-5.1模型时出现的工具调用循环问题,提供了官方修复方案。
智
智谱 GLM
·
25 天前
快讯
智谱AI
GLM-5.1
工具调用
Bug修复
智
开源模型工具调用能力大考:你的Agent够“智能体”吗?
Hugging Face发布新基准测试,帮助开发者评估开源模型在自定义工具调用与智能体任务中的实际表现。
H
Hugging Face
·
27 天前
开源模型
智能体
基准测试
工具调用
H