「新能安」共找到 7771 篇相关文章
半年复盘,AI迎来预训练后的新瓶颈。
2025年上半年AI领域发展加速,编码和多模态能力提升。但模型在综合能力上遇到第二轮瓶颈,编码能力强时通用认知能力‘拉胯’,或与RL阶段使用编程数据有关,红杉新基准或推动模型均衡发展。
腾讯开源Stand-In!轻量级身份保留视频生成新突破
生成符合指定身份的高保真视频挑战大,现有方法依赖大参数且兼容性不足。腾讯开源轻量级、即插即用的Stand - In框架,在身份保留文本生成视频任务中性能先进,兼容性强,有广阔应用潜力。
ACL 2026 | 腾讯混元Agents工具学习新范式
腾讯混元团队在 ACL 2026 Findings 发布的 ToolCPT 指出,Agent 用不好工具病根在预训练。它从真实代码挖工具,写说明书,融入预训练,实验显示能有效提升工具运用能力,但也有局限和成本。
ICLR2025 | LLM为什么能拒绝回答有害问题呢?
该论文首次系统性研究注意力头在LLM安全中的作用,提出Ships和Sahara方法,在极少参数改动下显著降低模型安全性,发现不同模型安全头高度重叠,为理解模型安全机制提供新视角。
iPhone 17 Pro居然能跑8B大模型!
iPhone 17 Pro竟能跑8B大模型,如Qwen3 - 8B,推理较流畅。作者换机一是因eSIM,二为拍视频。其认为AI普及需端侧落地,此机芯片性能是好信号,盼出优质iOS客户端。
2篇最新Anthropic论文,揭开LLM对齐新范式
Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方法效果显著。
openJiuwen社区首发Team Skills,定义Coordination Engineering新范式
文章围绕多智能体系统协作问题,指出传统任务编排方式的局限。华为JiuwenClaw团队发布Coordination Engineering新范式,通过Agent Team、Team Skills等能力,解决团队组建、技能沉淀、复用及进化等问题,并以旅行规划为例展示实战效果。
人工智能驱动的科研新范式及学科应用研究
文章指出AI驱动的科研新范式通过数据、算力、算法深度耦合嵌入科研全过程,引发多方面变革。总结其特征与演化方向,分析学科应用要求与成功案例,还提出我国推动AI科研应用的启示与建议。
DAA:李厂长在 Agent 时代给了个新坐标
作者参加百度Create 2026,李彦宏提出DAA(日活智能体数)概念,认为衡量平台和生态繁荣应看此指标,还预测未来全球DAA超100亿。对比Token,DAA是结果视角,更像Agent时代价值坐标。百度多款产品展示了Agent能力,还提出“芯云模体”新全栈。
没有内斗,Meta也没能留住PyTorch之父
PyTorch 之父 Soumith Chintala 宣布 11 月 17 日离开 Meta 并卸任负责人。他表示不想一辈子做 PyTorch,想尝试新事物。他回顾 11 年历程,称 PyTorch 已无需他,对团队有信心。