「跨视角视觉理解」共找到 1460 篇相关文章
2026 将近,世界模型到底更「世界」了吗?
近期 Runway 发布相关产品,让「世界模型」讨论再聚焦。其定义从强化学习语境延伸,业内理解不断变化,概念边界变模糊。如今被推到和 LLM 同级,出现概念同名但内核分裂现象。
《三体》“宇宙闪烁”成真!免佩戴裸眼3D屏登Nature
中国团队出品的显示屏EyeReal登上Nature,无需佩戴眼镜就能把3D画面精准投射到眼中。它尺寸小、成本低,融合计算光学与AI,解决了以往裸眼3D技术难题,画面流畅且解决“晕3D”问题。
杨植麟带 Kimi 团队深夜回应:关于 K2 Thinking 爆火后的一切争议
上周,月之暗面发布并开源 Kimi K2 Thinking,主打“模型即 Agent”,引发广泛关注。今日凌晨,杨植麟等团队成员在 Reddit 开展 AMA 活动,回应 K2 Thinking 相关问题,如 KDA 机制应用、训练成本、速度与准确性平衡等。
谷歌Gemini闹乌龙:我家狗子,竟被AI开除了「狗籍」!
2025年10月谷歌让Gemini for Home接管智能家居生态。它能识别人脸、快递等,还会生成家庭日报。不过,它也闹了把狗认成猫的乌龙。谷歌正改进识别准确度,这也是智能家居竞争中的小插曲。
超越Runway!Adobe发布新神器:P视频比P图还简单
Adobe联合多高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习能力和知识迁移,其效果超Runway,还展现涌现能力。
马斯克宣布开发 Grokipedia,目标超越维基百科,改善信息偏见
马斯克宣布 xAI 开发 Grokipedia,称其是对维基百科的巨大改进,也是理解宇宙的必要一步。维基百科存在左翼偏见问题,Grokipedia 旨在建立无偏见知识库,引发广泛讨论,名字也有争议。
DRAM技术发展综述:历史、技术路线图与未来展望
本文深入分析DRAM技术,追溯其历史,探讨当前格局与未来前景,比较其与SRAM优劣,考察中国主要DRAM企业发展历程并与国际同行对比,旨在提供对DRAM和SRAM生态系统的全面理解。
百度Qianfan-VL,发票/图表/合同等PDF识别94.75%刷新纪录!
当前主流视觉 - 语言模型在企业级应用有难点,百度千帆团队提出Qianfan - VL系列多模态大模型,在通用和企业级任务表现出色,基于自研芯片训练,还提供框架与管线降低成本。
全球图生视频榜单第一,爱诗科技PixVerse V5如何改变一亿用户的视频创作
爱诗科技PixVerse(拍我AI)功能丰富,普通用户可用热门模板整活,创作者有多样创作工具。其最新V5模型在图生视频项目全球排名第一,在多方面技术革新,推动AI视频创作发展。
物理学「AlphaGo时刻」?40年未竟之事被AI一举攻破,顶尖物理学家集体傻眼
AI主导设计的物理实验方案让顶尖科学家看不懂却成功了,它设计新颖光学元件布局使LIGO灵敏度提升10% - 15%。此外,AI还在量子纠缠实验设计、解析实验结果等方面展现强大能力,辅助物理学发现的新时代或已到来。