「学习能力」共找到 4248 篇相关文章
DeepSeek开源大模型记忆模块!梁文锋署名新论文,下一代稀疏模型提前剧透
DeepSeek最新论文给Transformer加上“条件记忆”,补上原生知识查找机制。梁文锋署名,与北大团队合作。提出全新范式及Engram模块,解决传统N - gram问题,研究稀疏性分配,验证推理能力提升,兼顾工程优化。
小扎再出奇招:Meta员工绩效,AI来评判
Meta宣布从2026年起用AI衡量员工绩效,考察员工使用AI提升效率及构建工具的能力。今年还推出AI绩效工具Metamate。其他科技公司也在将AI融入员工工作,网友对此褒贬不一。
230个大模型在婴幼儿认知题上集体翻车!揭秘多模态大模型的核心知识缺陷
ICML 2025研究揭示多模态大模型在基础认知能力上表现不佳。研究者建测评题库CoreCognition测试230个主流模型,发现其存在核心知识缺陷,扩规模难补短板,还需补齐核心知识。
字节Seed最新版原生智能体来了!一个模型搞定手机/电脑/浏览器自主操作
字节Seed发布最新版原生智能体UI - TARS - 2,采用All in one原生设计,表现优于Claude和OpenAI Agent等。它通过多轮强化学习,解决智能体操作图形界面的四大难题,在多测试中表现出色。
Meta提出StepWiser,让模型学会“反思”自己的推理过程
Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成式评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。
耶鲁等团队联合发布首个虚拟细胞Agent,可自动设计出先进的模型
耶鲁等团队发布首个多智能体系统CellForge,可自动化设计虚拟细胞模型。它能输出模型架构和代码,有跨模态能力,性能超多个领域代表性模型,可降低科研门槛,加速药物研发。
让AI主动干活,给你找服务,鸿蒙“6”啊
在HDC 2025上,鸿蒙展示服务分发展示新能力,能让服务主动找用户。它形成Agent行动网络,推出“探索”服务流。奈雪、东方财富等已加入,华为为开发者提供多种工具及激励政策。
西方忘了怎么制造东西,现在它又在忘记代码
文章以国防工业为例,指出西方制造业存在知识流失、产能恢复困难问题。如重启“毒刺”导弹生产线困难,欧洲炮弹交付延期。软件行业也类似,AI使初级工程师能力培养受阻,可能重蹈覆辙。
西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026
过去两年视频生成发展近成熟,但多数模型缺乏空间结构稳定建模能力。西湖大学AGI Lab团队提出论文,将问题落回推理阶段,让相机轨迹成约束条件,推进视频生成到三维结构约束建模。
马斯克惊叹!DeepSeek和Kimi先后出手,捅破了Transformer的「潜规则」!
文章介绍了DeepSeek和Kimi在残差连接上的突破。DeepSeek让连接权重可学习,用数学约束保证稳定性;Kimi将注意力机制用于层间连接,解决了更根本的问题,性能提升显著。