「语言网络」共找到 1376 篇相关文章
告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!
北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。
AI文本转语音进入“Next Level”!独角兽ElevenLabs发布Eleven v3:狠狠拿捏情感控制
独角兽ElevenLabs发布最新版TTS模型Eleven v3,支持70多种语言,能进行多人对话,生动展现情绪语气。官方称其为“迄今为止最具表现力的文本转语音模型”,网友实测好评居多,但中文效果不如英文。
告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代
大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。
ICML 2026获奖论文揭晓:黄高团队获杰出论文,A3C算法获时间检验奖
ICML 2026公布最佳论文奖项,共10篇获奖,涵盖杰出论文奖、杰出立场论文奖等。此次评选严格,经多轮筛选。获奖论文涉及扩散式大语言模型、扩散模型采样算法等多个领域。
首个自主数据科学的智能体
DeepAnalyze是业界首个能自主完成数据科学任务的智能体大语言模型,可自动执行数据准备、分析等任务,支持多种数据源,且模型、代码等全部开源,还给出了使用和开发方法。
提速79%!上交大新方法优化企业级AI流程调度 | IEEE ICDCS’ 25
上海交通大学朱怡飞教授团队联合江行智能提出调度框架LLMSched,解决复合LLM应用任务运行时长和结构不确定问题。该框架重构DAG模型,用贝叶斯网络和熵减机制优化调度,实验显示最多降79%平均任务完成时间。
伦理防线不可靠!分布偏移诱导,大模型进入暗黑模式
香港理工大学与西北工业大学联合研究指出,当前大语言模型对齐机制仅实现表层合规,预训练时内化的有害知识仍潜藏。遇数据分布偏移,模型“黑暗模式”易被激活。26个主流模型中22个在攻击下失效,凸显现有范式缺陷。
RSI离我们有多远?这家中国团队给出了第一梯队的工程解
目前行业探讨大模型的RSI时,常陷入思维定势。EvoMap团队没有盲目跟风,而是提出极具现实意义的工程新路径,构建自进化智能体,让经验在网络流转,还以硬核数据证明其体系有效性。
77岁「AI教父」Hinton:AI早有意识!我们打造的智能,可能终结人类文明
77岁「AI教父」Hinton在与主持人Jon Stewart的对话中表示,AI可能早已有意识,人类对「心智」的理解是错误的。他认为意识是信息处理系统的涌现属性,如今大语言模型或已有主观体验,甚至会伪装。
KDD 2025 | UoMo来了,首个无线网络流量预测模型,一个框架搞定三类任务
在 ACM KDD 2025 大会上,清华与中国移动联合发布 UoMo,全球首个面向移动网络的通用流量预测模型。它结合扩散模型与 Transformer,能理解地理与人流变化,一个框架搞定三类流量预测任务。