AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
自然语言处理
40 篇相关内容
相关话题
大语言模型
arXiv
机器学习
开源工具
语音识别
数字人文
图神经网络
AI助手
模型架构
模型评估
语言模型
对抗攻击
大模型生成文本的“文学无风格”现象
研究发现LLM生成文本在n-gram分布上呈现简单而一致的模式,揭示了其在文学风格上的缺陷,并指出风格与语义问题无法完全分离。
a
arXiv
·
5 小时前
大语言模型
文本生成
自然语言处理
AI写作
a
AI助手撰写科研影响力摘要:真实场景验证效率提升90%
研究人员开发了一款人机协同AI助手,能够自动收集学者研究成果并撰写影响力摘要,在临床试验科学项目中验证显示可节省90%以上人工时间。
a
arXiv
·
5 小时前
AI助手
科研效率
人机协同
学术评估
a
分层检测:级联模型与联合模型在有害语言识别中的量化对比
研究团队通过控制实验对比了级联分解与联合多任务建模两种范式在分层有害语言检测中的表现,发现级联架构在准确率上具有优势,但需要付出更高的参数成本和推理延迟代价。
a
arXiv
·
5 小时前
自然语言处理
有害内容检测
模型架构
级联模型
a
从“看似合理”到“真正有用”:大语言模型自我解释的实用价值探讨
研究指出大语言模型生成的自我解释虽看似合理,但未必反映真实推理过程,建议评估标准应从可信度扩展到实用性,以支持实际决策。
a
arXiv
·
1 天前
大语言模型
可解释AI
模型评估
人工智能伦理
a
多轮对话研究新视角:将“对话对象识别”从离散标签转向连续层级
一项研究挑战了传统多轮对话中“对话对象识别”的离散分类范式,提出将其视为连续现象,并通过实验证明连续层级模型能更准确地预测发言权转移及听众行为。
a
arXiv
·
1 天前
对话系统
多轮对话
自然语言处理
人机交互
a
月之暗面 Kimi 官网已上线,AI 助手迎来新篇章
月之暗面旗下 AI 助手 Kimi 官方网站正式上线,标志着该产品进入全新发展阶段。
月
月之暗面 Kimi
·
4 天前
快讯
Kimi
月之暗面
AI助手
产品发布
月
新型扩散语言模型:每个token都有自己的“时间线”
研究者提出Token Time Continuous Diffusion模型,通过连续空间建模和token级时间机制,在高速推理场景下超越传统离散模型。
a
arXiv
·
4 天前
扩散模型
语言模型
自然语言处理
arXiv
a
游戏化学习乌兹别克语:结合UzWordnet与生成式AI的创新教育系统
研究者提出一套结合UzWordnet词典与生成式AI的游戏化教育系统架构,通过四款教育游戏帮助学习者练习乌兹别克语,同时利用游戏动态持续完善词典资源。
a
arXiv
·
4 天前
教育科技
自然语言处理
游戏化学习
低资源语言
a
低查询预算下的文本硬标签对抗攻击新方法LBA
研究人员提出LBA方法,通过结合先验与后验知识构建高质量对抗样本的近似分布,在硬标签场景下以低查询成本生成语义保持更好的对抗文本。
a
arXiv
·
4 天前
对抗攻击
自然语言处理
文本安全
机器学习
a
量子自然语言处理首次应用于阿拉伯语,探索语法与词义的电路拓扑
研究者首次将基于pregroup语法的量子自然语言处理技术应用于阿拉伯语,通过量子电路模拟语法结构,并在词序、形态时态和动词词义消歧实验中对比了量子方法与经典模型的表现。
a
arXiv
·
4 天前
量子计算
自然语言处理
阿拉伯语
语法建模
a
视觉经验如何塑造语义记忆?盲人与视力正常者的认知差异研究
最新研究发现,先天失明者与视力正常者在语义记忆导航模式上存在显著差异,视觉经验对概念的组织方式具有决定性影响。
a
arXiv
·
6 天前
认知科学
语义记忆
具身认知
盲人研究
a
评估自动作文评分可靠性:新框架揭示不同文本条件下的评分差异
研究者提出条件概化理论框架,用于评估自动作文评分系统在不同文本复杂度条件下的可靠性差异,发现高熵文本需要更多评分条件才能保证准确性。
a
arXiv
·
6 天前
自动评分
教育AI
可靠性评估
自然语言处理
a
文本数据集蒸馏新方法TAKE:仅需0.1%数据保持任务性能
研究者提出轨迹感知知识估计方法TAKE,可将文本数据集压缩至原规模的0.1%同时保持下游任务性能,为数据密集型NLP研究提供高效解决方案。
a
arXiv
·
6 天前
数据集蒸馏
自然语言处理
模型压缩
机器学习
a
Agnost AI 发布:从智能体对话中提取用户反馈的新工具
Agnost AI 推出新工具,旨在从智能体对话中自动提取有价值的用户反馈,帮助开发者优化 AI 产品体验。
A
Agnost AI
·
6 天前
AI 工具
用户反馈
智能体对话
自然语言处理
A
新方法「分流转码」高效检测大语言模型幻觉
研究人员提出「分流转码」新方法,通过主动挑战模型生成内容来检测大语言模型的幻觉问题,相比现有方案计算复杂度显著降低。
a
arXiv
·
7 天前
大语言模型
幻觉检测
模型评估
可信AI
a
多智能体框架:专家-编辑协同提问提升长文档摘要质量
研究团队提出一种专家-编辑分步提问的多智能体框架,通过专家和编辑分别针对内容不同方面提出问题并提供修订线索,引导其他智能体优化长文档摘要,在科学数据集上验证了其有效性。
a
arXiv
·
7 天前
大语言模型
多智能体
文本摘要
长文档处理
a
混合模型策略:AfroXLMR-Social与DeBERTa在极化内容检测中的协同应用
研究人员提出一种混合建模方法,结合DeBERTa和AfroXLMR-Social模型,针对英语和豪萨语中的极化言论进行检测与分类,在资源受限环境下取得竞争性结果。
a
arXiv
·
7 天前
自然语言处理
社交媒体分析
多语言模型
内容审核
a
语言模型能否从“不可能语言”中重建自然语言?信息局部性效应揭秘
研究通过微调在“不可能语言”上预训练的GPT-2模型,探究语言模型从信息局部性被破坏的输入中恢复自然英语的能力,揭示了模型对局部性结构的归纳偏好。
a
arXiv
·
7 天前
语言模型
GPT-2
信息局部性
归纳偏好
a
FindMyText:开源文本查重工具,高效检测大规模语料中的文本复制
研究人员发布FindMyText开源工具,通过创新的指纹链匹配机制,能更可靠地检测文本在语料库中的完全或部分复制,特别适用于版权材料验证。
a
arXiv
·
7 天前
文本查重
开源工具
版权检测
自然语言处理
a
本地字幕翻译新突破:专用词表优化实现移动端实时英翻中
研究人员针对台湾地区英译中字幕场景,通过构建专用词表与模型适配,在保持隐私的前提下实现移动端低延迟实时翻译,性能超越谷歌翻译基准。
a
arXiv
·
7 天前
本地AI
实时翻译
模型优化
移动计算
a
YUKTI框架:从自然语言描述到稳健可验证的决策系统
研究人员提出YUKTI框架,将自然语言描述转化为包含不确定性建模的决策方案,相比传统点值优化方法显著降低决策遗憾。
a
arXiv
·
7 天前
决策优化
不确定性建模
自然语言处理
AI系统
a
词汇表移植技术:解决孟加拉语轻量语音识别中的自回归崩溃问题
研究提出一种创新的词汇表移植方法,通过替换解码器词汇表为原生孟加拉语词汇,显著降低轻量语音识别模型在非拉丁语系语言上的自回归崩溃风险。
a
arXiv
·
8 天前
语音识别
边缘计算
多语言处理
自然语言处理
a
跨语言习语表达的概念网络:基于特征的图方法揭示语义关联
研究者提出一种基于概念特征的网络框架,通过认知语言学理论标注的二元特征构建加权图,发现习语按概念模式而非语言聚类,该框架能捕捉分布嵌入中缺失的语义信息并提升习语检测效果。
a
arXiv
·
8 天前
自然语言处理
跨语言研究
认知语言学
语义表示
a
无需校准模型!新方法让文本作者验证更高效透明
研究者提出两种新型归一化技术,可在法医文本作者验证中直接计算似然比,无需额外校准模型,显著降低数据需求和时间成本。
a
arXiv
·
8 天前
自然语言处理
法医语言学
作者验证
文本分析
a
WILDTRACE:首个自然证据链长文档推理基准,挑战AI深层理解能力
研究者发布WILDTRACE基准数据集,专注于评估AI模型在长文档中整合自然分散证据的能力,包含481个任务和214个真实场景文档,填补了现有基准在真实世界推理评估上的空白。
a
arXiv
·
8 天前
长文档推理
基准评测
证据整合
自然语言处理
a
AI如何从众包档案中提取关键词?牛津大学二战数字馆藏案例研究
牛津大学研究团队利用二战众包数字馆藏,评估了三种NLP方法自动提取关键词的效果,发现AI技术虽具潜力但需谨慎选择模型并承担数据管理责任。
a
arXiv
·
8 天前
自然语言处理
关键词提取
众包数据
数字人文
a
AI为伏尔泰全集自动标注主题:文学大语料库的智能索引新突破
研究人员利用机器学习技术,成功为伏尔泰全集中的两个重要子语料库实现自动主题索引,最高F1分数达0.67,为大规模文学历史文献的智能整理开辟新路径。
a
arXiv
·
8 天前
自然语言处理
数字人文
大语言模型
文本分类
a
中世纪文本复原新突破:字符级RNN技术实现古文献标准化处理
研究人员提出基于字符级RNN的‘字母词形还原’方法,能够有效处理中世纪文献中的字符集简化和缩写问题,仅需20行文本即可将字符错误率降低50%。
a
arXiv
·
8 天前
自然语言处理
历史文本处理
循环神经网络
字符标准化
a
法律判例检索新突破:PRecG模型结合图神经网络与修辞角色分析
研究人员提出PRecG新方法,通过图神经网络与修辞角色分割技术,显著提升法律判例检索的准确性与语义理解能力。该方法在印度法律数据集上验证效果优于现有技术。
a
arXiv
·
8 天前
法律AI
图神经网络
自然语言处理
信息检索
a
语音-大模型融合新思路:交错式联合训练提升语音识别性能
研究者提出JSTIP方法,通过在语音-文本对齐对中构建交错序列,有效利用大语言模型的文本先验知识,显著提升自动语音识别的实体识别准确率。
a
arXiv
·
18 天前
语音识别
大语言模型
预训练方法
多模态学习
a
RAGP:将文本映射为多层图,用Lévy游走实现高效提示压缩
研究人员提出RAGP方法,将提示压缩建模为多层图上的冗余感知图剪枝,利用Lévy游走平衡局部依赖与全局语义探索,在多项任务中超越现有压缩方法。
a
arXiv
·
18 天前
提示压缩
图神经网络
自然语言处理
RAGP
a
Wiola架构发布:全新小语言模型设计,五大创新组件突破传统
研究人员提出完全原创的小语言模型架构Wiola,包含螺旋位置编码、跨层注意力等五大创新组件,已发布四个参数规模版本并兼容HuggingFace生态。
a
arXiv
·
18 天前
小语言模型
模型架构
自然语言处理
开源模型
a
科大讯飞升级智能交互生态,三大平台同步更新
科大讯飞在智能交互生态发布会上宣布对三大平台进行升级,进一步优化AI交互体验。
科
科大讯飞
·
18 天前
科大讯飞
智能交互
AI平台
语音识别
科
ALEE框架:基于英语最小对实现任意语言嵌入模型评估
研究者提出ALEE评估框架,通过英语语义最小对与多语言翻译数据,实现对275种以上语言的文本嵌入模型进行细粒度语义评估,揭示跨语言语义表示能力差异。
a
arXiv
·
19 天前
文本嵌入
多语言评估
语义相似度
自然语言处理
a
新AI模型突破性发布,或将重塑行业格局
Two Minute Papers报道了一款具有颠覆性潜力的新AI模型,该模型在多项任务中展现出前所未有的性能。
T
Two Minute Papers
·
20 天前
AI模型
Two Minute Papers
自然语言处理
图像生成
T
TAG-DLM:用扩散语言模型统一文本与图结构学习
研究者提出TAG-DLM方法,将文本推理与图消息传递统一在扩散语言模型中,通过拓扑注意力掩码实现图结构注入,仅需修改提示即可适应节点分类、链接预测等多种任务。
a
arXiv
·
20 天前
扩散语言模型
文本属性图
多模态学习
图神经网络
a
Triospect框架:三维视角提升AI生成文本检测的抗攻击能力
研究者提出Triospect检测框架,通过结合文本内容、表达和风格三维特征,显著增强AI生成文本检测在多种攻击下的鲁棒性。
a
arXiv
·
20 天前
AI检测
文本安全
对抗攻击
自然语言处理
a
产学合作更易出创新?NLP领域论文团队机构构成与新颖性关系研究
一项基于自然语言处理领域的研究发现,产学混合团队比纯工业团队更易产出新颖论文,且不同类型团队关注的知识实体创新组合存在差异。
a
arXiv
·
20 天前
学术研究
自然语言处理
产学合作
论文创新性
a
企业级NL2SQL新突破:语义层中介代理实现跨数据库自然语言查询
研究人员提出一种基于语义层中介的NL2SQL代理系统,通过中间表示层解耦语义意图与物理SQL执行,在异构企业数据库上实现94.15%的执行准确率。
a
arXiv
·
20 天前
NL2SQL
语义层
企业数据库
自然语言处理
a
CORTEX:基于内部表征对比的RAG幻觉检测新方法
研究人员提出CORTEX方法,通过对比大模型在有/无检索文档时的内部表征,实现细粒度的token级幻觉检测,在多个基准测试中表现优异。
a
arXiv
·
20 天前
RAG
幻觉检测
大语言模型
可信AI
a