「超智能与未来」共找到 6695 篇相关文章
究竟会花落谁家?DeepSeek最新大模型瞄准了下一代国产AI芯片
近期,DeepSeek发布V3.1新模型,采用全新混合推理架构,在多任务表现上有提升。它采用UE8M0 FP8,或为国产推理芯片优化机制。国内多家厂商新一代AI芯片支持FP8,未来国产大模型或针对其专门优化。
读万卷书,大模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源
Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。
FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾
文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。
击败PI ,清华系具身公司包揽「具身奥林匹克」三项全球第一,刷新世界纪录!
在Benjie's Olympics赛事中,星动纪元凭借自研具身智能模型获三项全球第一,击败具身领域老牌公司PI。该赛事规则严苛,星动纪元在剥橘子、开锁、翻袜子任务中表现出色,此前其在技术研发和场景落地也成果颇丰。
Skill vs App:一场入口范式的争夺
量子位举办的「龙虾时代,Skill会吃掉App吗?」主题沙龙上,多位从业者围绕Agent生态、Skill能力边界、App未来形态等话题展开讨论。指出Skills不会完全干掉App,App会以Skill形式继续存在并进化,还探讨了App在AI时代的多种走向及面临的问题。
对话际数科技联创:质量赛道的先驱者,要做空间数据的「精炼厂」
本文是对际数科技三位联合创始人的访谈。在具身智能时代数据采集火热但数据荒严重背景下,际数关注数据质量,其以测绘背景为底气,用‘一张图、一把尺、一个飞轮’搭建技术护城河,打造质量因子库,还创新训练质量模型,有稳定商业路径。
跳过“逐字生成”!蚂蚁集团赵俊博:扩散模型让我们能直接修改Token | MEET2026
在量子位MEET2026智能未来大会上,蚂蚁集团赵俊博称扩散架构能直接修改控制token,理论上速度更快、成本更低。他团队押注扩散架构,近期开源千亿规模LLaDA 2.0。该领域虽处早期,但发展快,吸引众多巨头和初创公司布局。
为什么GPT-5算得出微积分,却数不清积木?
文章对GPT - 5展开系统化空间能力测评,涵盖8个基准、超10亿token成本。提出“空间智能六维图谱”,发现GPT - 5在MM和SR达人类水平,但MR、PT等方面有短板,还揭示闭源与开源模型在复杂任务上差距小等情况。
苹果不吹 AI,反而成功了?
北京时间9月10日苹果发布会,与iPhone 16发布时大肆宣传AI不同,此次重点在硬件及AI幕后支持。此前苹果对AI宣传过度致部分功能未推出引失望,且在智能体AI助手进展落后。多数人不因AI换机,给了苹果试错时间,但它在AI竞赛中落后,中国厂商布局更快。
新一代AI教师是什么样?学而思让它从L2「助手」跃迁至L3「老师」
在AI应用落地成关键的当下,教育成AI融合创新前沿。好未来CTO田密提出「AI教师L1 - L5分级」理论,指出当前AI老师达L2水平,L3正演进。学而思学习机的「小思AI一对一」迈向L3,依托硬件和自研大模型,结合优质内容,从可用走向可信。