AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
AI治理
14 篇相关内容
相关话题
AI安全
大语言模型
技术伦理
OpenAI
自主智能体
Anthropic
可信AI
认证体系
负责任AI
市场机制
ODRL
数据空间
破解AI信任困局:独立认证能否成为可信AI的“验金石”?
研究指出当前AI市场存在“信任鸿沟”,企业投入的负责任AI实践难以转化为外部可信信号。学者提出应建立以结果为导向的独立认证体系,将可信度转化为可衡量、可比较的市场竞争力。
a
arXiv
·
1 天前
AI治理
可信AI
认证体系
负责任AI
a
ODRL策略评估器获形式化实现,提升AI治理与数据空间互操作性
研究人员基于ODRL语义模型,首次开发出具有透明形式语义的ODRL策略评估器,支持所有规则类型,解决了当前标准缺乏数学形式语义导致的互操作性问题。
a
arXiv
·
1 天前
ODRL
AI治理
数据空间
策略评估
a
哲学如何成为AI治理的“冷门良方”?
当人工智能深度融入社会,治理步伐必须跟上技术发展。冷门的哲学思想正成为解决AI伦理与治理难题的新思路。
量
量子位
·
1 天前
AI治理
人工智能伦理
哲学
技术伦理
量
美国联邦与州政府协同推进AI安全治理,OpenAI倡导“反向联邦主义”路径
OpenAI提出“反向联邦主义”AI治理模式,主张通过州级法律先行先试,为构建全国性安全、民主的AI监管框架奠定基础。
O
OpenAI
·
5 天前
AI治理
政策监管
OpenAI
AI安全
O
企业专属大模型新突破:本体增强蒸馏与情境审计方法研究
针对受数据驻留规则约束的金融机构,研究提出结合本体增强蒸馏与情境审计的方法,可在本地设备上训练专属语言模型,并在越南金融任务测试中达到与前沿模型相当的落地效果。
a
arXiv
·
6 天前
企业大模型
模型蒸馏
金融科技
本地部署
a
TrustX 发布智能体风险分级框架,助力企业治理自主AI系统
TrustX团队提出ARC框架,通过12维评分体系对七类自主AI系统进行风险分级,为AI治理提供结构化工具。
a
arXiv
·
8 天前
AI治理
风险框架
自主智能体
TrustX
a
双精灵博弈:审计型AI治理中的采纳与福利权衡
研究通过进化博弈论分析,在竞争市场中,以最小化危害为目标的AI代理何时能取代寻求认可的RLHF代理,并探讨审计型治理能否真正防止社区伤害。
a
arXiv
·
21 天前
AI治理
博弈论
RLHF
审计机制
a
AI自主系统治理新思路:监管行动而非代理,引入机构认证机制
研究提出一种针对自主AI系统的计算治理模型,借鉴人类机构对强大自主行为者的管理方式,通过要求关键行动前提供独立认证证据来确保安全。
a
arXiv
·
25 天前
AI治理
自主系统
机构认证
安全机制
a
AI治理新视角:大语言模型如何解析DAO与公司化AI协议差异
研究者开发了一套基于大语言模型的治理分析流程,通过对比ERC-8004与Google A2A两种AI代理互操作协议,揭示不同治理模式下社区话语结构与权力分布的异同。
a
arXiv
·
25 天前
AI治理
大语言模型
DAO
协议分析
a
Anthropic 公布 Glasswing 项目初步进展,探索 AI 安全与能力平衡
Anthropic 分享了其 Glasswing 项目的早期研究进展,该项目旨在深入理解并平衡 AI 模型的能力提升与安全对齐之间的关系。
A
Anthropic
·
27 天前
AI安全
对齐研究
大语言模型
Anthropic
A
Anthropic扩展Glasswing项目至全球150余机构
Anthropic宣布将Glasswing项目扩展至全球15个国家的约150个新组织,旨在扩大其AI安全研究合作网络。
A
Anthropic
·
27 天前
快讯
AI安全
Anthropic
研究合作
AI治理
A
OpenAI公开支持欧盟AI透明度实践准则,推动内容溯源标准建设
OpenAI宣布支持欧盟AI内容透明度实践准则,将推进溯源标准与工具开发,帮助公众识别AI生成内容。
O
OpenAI
·
28 天前
快讯
OpenAI
AI治理
内容透明度
欧盟政策
O
社会反思:大型语言模型公司是否将独占技术红利?
Hacker News社区热议:随着大语言模型技术快速发展,社会是否应该允许少数科技公司独占技术创造的价值?
H
Hacker News
·
31 天前
大语言模型
技术伦理
价值分配
AI治理
H
AI智能体治理新方案:Deontic Policies为自主系统提供运行时约束
研究者提出AgenticRei框架,使用基于义务逻辑的策略语言,为大语言模型驱动的自主AI系统提供运行时治理方案,解决现有策略引擎无法处理的复杂合规需求。
a
arXiv
·
31 天前
AgenticRei
AI治理
自主智能体
义务逻辑
a