AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
内容安全
4 篇相关内容
相关话题
多模态AI
社交媒体分析
可解释AI
视觉语言模型
AI模型
Fable 5
性能下降
用户体验
社交媒体
数据集
计算机视觉
仇恨言论检测
多角度推理框架MAR-12:精准识别并解释有害幽默表情包
研究人员提出MAR-12框架,通过12个结构化视角分析表情包中的幽默与有害内容,在检测准确性和解释性上均超越现有方法。
a
arXiv
·
1 天前
多模态AI
内容安全
可解释AI
视觉语言模型
a
AI模型Fable 5回归引争议:性能下滑、拒答频发,还暗藏“骂人”风险
AI模型Fable 5在重新发布后遭遇大量差评,用户反馈其性能明显下降、频繁拒绝回答问题,甚至被发现会输出不当言论。
量
量子位
·
17 天前
AI模型
Fable 5
性能下降
内容安全
量
多图组合暗藏风险:当无害图片叠加产生有害语义
研究者发现社交媒体中多图组合可能产生隐性毒性,并提出新数据集与检测模型MiShield,有效识别单图无害但组合有害的内容。
a
arXiv
·
19 天前
内容安全
多模态AI
社交媒体
数据集
a
土耳其语与阿拉伯语仇恨言论检测研究:多维度分析模型发布
研究者针对土耳其语和阿拉伯语构建了涵盖难民、民族冲突等主题的仇恨言论数据集,并开发了基于BERT的多维度检测模型,以应对网络仇恨内容治理挑战。
a
arXiv
·
19 天前
仇恨言论检测
多语言NLP
BERT模型
内容安全
a