「科学具身智能」共找到 3975 篇相关文章
谷歌神秘模型Kingfall泄漏!
近日,谷歌AI模型Kingfall在AI Studio平台短暂开放后意外曝光。它具备多模态处理能力,上下文窗口6.5万个token,有两种模式。生成SVG矢量图能力超Claude 4,身份猜测不断。
从游戏少女到AI女神!她用物理驯服AI,让飓风预测快1000倍
本文讲述了AI领域领军人物Rose Yu的成长历程,她从玩游戏起步,到用物理知识改进交通预测、加速飓风模拟,还设想打造“AI科学家”辅助科研,强调AI是助手而非替代者。
人形机器人终于学会洗碗了
Figure机器人学会洗碗,用的是叠毛巾和分包裹同款Helix架构,无新算法和特殊工程,仅增加新数据。该架构是端到端“视觉 - 语言 - 动作”模型,同一系统增数据就能学新技能。
MMLab@HKU 闪耀 CVPR 2025!与全球顶尖学者共话 AI 前沿
CVPR 2025 于 6 月 11 日至 15 日在美国纳什维尔举行,MMLab@HKU 携 24 篇高质量论文亮相。其还是三项国际竞赛的发起与主办方,主办六项前沿活动,研究成果展示了多领域进步。
ICLR最佳论文:Transformer天生简洁
2026年ICLR最佳论文对Transformer做深度思维体检,指出其架构真正威力在于描述概念时比RNN等简洁指数级甚至双重指数级,但验证其内部逻辑计算成本高昂,为解释其能力开新窗。
Transformer论文作者重造龙虾,Rust搓出钢铁版,告别OpenClaw裸奔漏洞
Transformer作者Illia Polosukhin重造安全版龙虾IronClaw。OpenClaw安全状况差,IronClaw用Rust重写,建立四层防御,还能防提示注入。其背后是NEAR更大构想,目标是用户掌控数据和资产。
智源发布 2026 十大 AI 技术趋势:世界模型成 AGI 共识方向
2026年1月8日,智源研究院发布《2026十大AI技术趋势》,指出AI演进核心从语言学习转向理解物理世界秩序。报告阐述了AI从数字迈向物理世界的三条驱动主线,并给出十大趋势,为行业提供布局锚点。
AI 如何讲好一个多人故事?首个支持多角色互动的3D场景叙事系统
首尔国立大学提出全新框架,能生成虚拟动态场景并支持多角色上下文动作生成。引入LLM拆解复杂任务,系统用事件驱动方式规划动作,还构建基准评估相关能力,有良好扩展性和实用性。
DeepMind让AI当「上帝」,导演一场只有AI演员的「西部世界」
Google DeepMind和多伦多大学研究人员受TTRPG和现代游戏引擎启发,提出Concordia软件库。它基于「实体 - 组件」架构,将工程师与设计师角色分开,能灵活构建多角色生成式AI系统,满足不同需求。
用多模态LLM超越YOLOv3!强化学习突破多模态感知极限|开源
华中科技大学、北京邮电大学等多所高校研究团队共同推出纯多模态开源LLM——Perception-R1,该模型用强化学习优化视觉感知,目前论文和代码均已开源,其在视觉任务上表现出色,为后续研究提供强大baseline。