「应用视觉团队」共找到 5606 篇相关文章
用人类脑电波教 AI 开车,这位清华 90 后学者直言隐式信号里藏着 AGI 的关键 | 万有引力
清华大学龚江涛团队用人类驾驶员脑电波教会自动驾驶模型“思考”,成果E³AD发表于NeurIPS 2025。龚江涛从计算机转向人机交互,在多段科研经历中积累经验,探索将人类“直觉”赋予AI。
字节跳动发布SeedFold,蛋白质结构预测相关多任务超越谷歌AlphaFold 3,揭示大模型缩放新秘诀
字节跳动Seed团队推出新一代折叠模型SeedFold,在多个蛋白质相关任务性能上超越谷歌AlphaFold 3。该研究为有效缩放生物分子基础模型提供新思路,推出加宽模型、线性三角注意力等方法。
继宇树后,唯一获得三家大厂押注的自变量:具身模型不是把DeepSeek塞进机器人
2026 开年,自变量机器人获字节、红杉 10 亿融资。自变量认为具身智能不是 AI 模型应用,需“生于物理世界、用于物理世界”的基础模型,其有自研成果,还开源模型组织黑客松。
独家|智元成立灵巧手子公司「临界点」,前腾讯Robotics X 熊坤带队
AI科技评论独家获悉,智元机器人拆分灵巧手业务成立新公司「临界点」并完成首轮融资,由熊坤带队。智元过去一年投资活跃,拆分或因技术门槛高、应用广,且自身有技术积累。
让大模型“吃一堑长一智”,南理工百度等提出模型记忆新方法
南京理工大学联合百度等提出新方法ViLoMem,构建视觉流+逻辑流的双流语义记忆,让模型“从错误中学习”。它能在多模态基准提升模型表现,强模型记忆还可迁移给小模型。
具身智能「全明星日」来袭!智源组局30+行业掌门人,激辩机器人终极命题
2025年是具身智能「爆发之年」。智源具身2025 OpenDay上,30多位行业大佬激辩,议题包括具身架构、数据获取、硬件瓶颈、应用落地等,智源还开源多项成果助力行业发展。
多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解的基准
香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上的不足,也为未来发展指明方向。
仅需10%思维链标注,等同全量性能!中科院发布推理监督新范式
中科院计算所团队提出新框架PARO,让模型学习固定推理模式自动生成思维链,只需标注1/10数据就能达全量人工标注性能,适合规则清晰领域,为推理监督提供新思路。
阿里亲身入局具身智能!Qwen内部组团,通义千问技术负责人带队
阿里Qwen团队组建具身智能小分队,由通义千问技术负责人林俊旸带队。外媒称这是阿里最明确的物理AI系统探索,此前阿里已有投资布局,此次是其AI战略关键落点。
吴恩达:自动化测试在 AI 编程时代将变得极其重要
吴恩达分享团队用AI编程助手的经历,如Agent删代码。他认为AI辅助编程时代,自动化测试愈发重要,智能体测试能发挥作用,还强调优先测试基础设施代码,后端测试更关键。