「规模化落地」共找到 1123 篇相关文章
对话智源王仲远:具身智能“小组赛”才刚刚开打,机器人需要“安卓”而非 iOS
智源研究院院长王仲远在对话中指出大语言模型发展遇瓶颈,AI 需走向物理世界。智源推出“悟界”系列,试图打破具身智能“循环悖论”,做具身智能的“安卓”,还提出大小脑协同策略,认为具身智能“小组赛”未结束。
PITT | 提出PhyT2V框架:让文生视频(T2V)更符合物理规律(CVPR2025)
当前T2V技术迈向推理驱动阶段,物理规律是关键约束。匹兹堡大学团队提出PhyT2V框架,不依赖模型重训练或大规模外部数据,可增强主流T2V模型能力,有低落地门槛和良好泛化性。
科大讯飞研发总监王磊磊将在 AICon 上海分享多模态降噪技术的实践与应用
5月23 - 24日AICon上海大会将聚焦AI前沿与产业落地。科大讯飞王磊磊将分享《复杂场景下的语音交互,多模态降噪技术的实践与应用》,介绍基于多模态融合的降噪技术体系及其在智能硬件中的应用。
AI卷到物理世界,小米迎来自己的主场?
该文探讨小米在物理AI领域的发展。物理AI与生成式AI有别,更重感知与执行。小米有手机、汽车、家庭入口,补齐多样能力,成全球首个在「人车家全生态」落地物理AI的公司,优势显著。
Axiom Math 对谈 SGLang:模型的下一步是可验证,结果层才是真正的护城河
在AGI Playground 2026圆桌论坛,Axiom Math联合创始人等探讨AI核心问题。提到AI进入生产环境,可验证或成瓶颈,还从长任务智能体、推理基建等多方面深入交流,如模型验证、基建优化等。
脑机接口迈入医疗器械时代:临床、支付与商业化的三道门|甲子引力X
今年脑机接口获首张侵入式三类医疗器械注册证,行业关注点转变。在「甲子引力X」圆桌对话中,六位投资人围绕临床、支付、商业化展开探讨,分享对不同场景的看法及对脑机接口走进生活的畅想。
这个开源项目 OpenStory,把 AI 短剧制作变成了一条可复制的工业流水线!
现在制作完整AI短剧流程繁琐,很多团队是小作坊式生产,效率低且难规模化。OpenStory开源项目站在成熟AI服务肩上,将AI短剧制作工业化,能把剧本变成风格统一的视频作品,解决诸多痛点。
让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni
openJiuwen社区发布业界最早工程化落地的多模态Skill范式Skill-Omni,让Agent经验从‘读得懂’升级为‘看得见’。它能将网页和视频视觉知识沉淀为多模态Skill,还介绍了生成及读取方式和适用任务。
机器人看视频学操作!伯克利首次打通互联网视频到灵巧手真机部署链路
UC Berkeley团队提出端到端流程,跑通从网络视频生成真实灵巧手实机执行轨迹链路。解决了单目RGB视频手-物交互重建、带噪声参考轨迹动作重定向及遥操作规模化难题。还给出数据筛选要点。
双榜SOTA!微软ACL2026新作重新定义AI长记忆
大语言模型落地中,AI长期记忆能力成瓶颈,传统RAG方案有局限。微软研究团队提出AI记忆框架Mnemis,受认识论与认知科学启发,在两大权威长期记忆基准达SOTA性能,工作被ACL2026主会议接收。