「自回归顺序」共找到 1242 篇相关文章
大模型的进化方向:Words to Worlds | 对话商汤林达华
量子位对话商汤林达华,探讨大模型发展。商汤的SenseNova - SI超越李飞飞团队模型,林达华认为单纯依赖参数规模的AI范式遇瓶颈,商汤推出NEO架构革新,还在落地应用优化,为年轻人指明新赛道。
Gemini 3 上线两周,ChatGPT 日活下降 6%,Altman 内部信拉响红色警报
2025年12月初,AI领域权力转换,Google新一代多模态模型Gemini 3挑战ChatGPT。自其发布两周,OpenAI日活降6%。Sam Altman发内部信拉响警报,要求聚焦提升ChatGPT核心体验。
锚定未来,安谋科技Arm China发布"AI Arm CHINA"战略
在ICCAD - Expo 2025上,安谋科技Arm China CEO陈锋发布“AI Arm CHINA”战略,表明全力投入AI决心。AI重塑产业逻辑,安谋科技发挥桥梁作用,推出“周易”X3等产品,构建AI计算生态。
实测全新 SkyReels :AI 创作,终于连成了一体
当前AI生成技术虽强,但视频创作仍门槛高、流程琐碎。昆仑万维推出全新SkyReels,是多模态创作系统,AI科技评论实测其画布、Agent等功能实用,它依托统一框架,核心竞争力在实现“统一性”。
LeCun力荐的JEPA杀入LLM,用CV的思路训练LLM,性能鲁棒性双丰收
LeCun团队提出LLM - JEPA,将JEPA自监督学习架构从视觉扩展到LLM。它能提升性能和鲁棒性,在多模型和数据集验证有效,但有训练开销大、泛化性不足等局限。
他,37岁华裔,靠AI成为福布斯400最年轻亿万富翁,身价180亿美金!
37岁华裔Edwin Chen成《福布斯400》最年轻亿万富翁,身价180亿美元。他拒绝VC融资,用积蓄打造估值300亿美元的AI数据标注公司Surge,希望让AI学会「人类的复杂性」,还担忧AI模型被错误优化。
苹果新研究:不微调、不重训,如何让AI提问效率暴增6.5倍?
苹果与牛津、港城大合作提出 BED - LLM 方法,能让 AI 解决问题能力提升 6.5 倍,无需微调重训。它基于序贯贝叶斯实验设计框架,通过三重智慧设计,经测试全面超越基准方法,或开启‘智慧对话’时代。
不靠海量数据,如何精准喂养大模型?上交Data Whisperer:免训练数据选择法,10%数据逼近全量效果
上海交通大学等团队提出 Data Whisperer,首个免训练的注意力驱动数据选择框架。它利用模型自身能力打分挑数据,无需训练与人工标注,用 10% 数据让微调效果逼近全量数据,在多方面领先传统方法。
Chrome危!AI浏览器新品大爆发,OpenAI都来抢饭碗
AI时代浏览器成兵家必争之地。英伟达投资的Perplexity推出AI浏览器Comet,OpenAI也将发布。老牌谷歌Chrome难撼动,新势力各有亮点,国内市场争夺也愈发胶着。
机器人新势力估值断层加速,具身智能靠什么穿越风暴?
文章指出机器人新势力估值断层加速,具身智能公司估值复杂,标准难统一。其智能路线收敛,但暂无领先团队。投资上,虽人才被认为处‘价值低谷’,但 VC 要回归商业本质,港股上市规则也引发担忧。