「人工智能领域」共找到 2121 篇相关文章
Sora没做到的,LongVie框架给解决了,超长视频生成SOTA
视频生成近年进步大,但生成超1分钟高质量长视频仍难。上海人工智能实验室等机构提出LongVie框架,解决时序不一致和视觉退化问题,还推出评测基准LongVGenBench,该框架在多项指标达SOTA。
π0.7发布,VLA押出了机器人的GPT-3时刻
今天凌晨,Physical Intelligence发布VLA模型π0.7,首次在机器人领域证明组合泛化。它用多样化prompt处理多样数据,涌现多种能力,还证明数据过滤可能是伪问题,架构基于前作,推动VLA回归。
中国开源首超美国:Hugging Face发布全球AI开源现状报告
Hugging Face发布报告显示,2025年开源AI生态繁荣,用户参与度高。中国首次超越美国,成月下载量最大的模型来源国。各国政府推动主权AI,硬件支持更多元,机器人和科学领域发展迅速。
拯救大模型的逻辑短板:Nature文章预测符号主义AI与神经网络的联姻将引爆下一场技术革命
结合逻辑系统与神经网络成AI热门趋势,神经符号AI崛起,旨在弥补神经网络短板。虽面临技术挑战,但已在多领域展现潜力,不过也有质疑声,其发展仍面临诸多难题。
最火VLA,看这一篇综述就够了
ICLR 2026爆火领域VLA全面综述来了!作者Moritz Reuss是2025年Apple AI/ML学者奖得主。文中明确VLA概念,介绍八大趋势,指出评测失真问题,还提及未来需重视数据质量与上下文学习。
CapRL:用强化学习突破Image Captioning训练瓶颈,3B模型性能媲美72B
上海人工智能实验室联合团队发布 CapRL,首个将 DeepSeek - R1 强化学习策略用于 Image Captioning。CapRL - 3B 模型在图像描述任务媲美 Qwen2.5 - VL - 72B,已开源,团队持续迭代优化。
一份最新具身智能中的世界模型&安全综述
本文分享2篇具身智能世界模型和安全挑战的综述。2025年10月的综述用三维坐标轴整合文献。还介绍世界模型分类、性能表现,围绕自动驾驶与机器人领域分析安全隐患并实证评估。
谷歌量子计算重磅突破登上Nature:首次实现可验证量子优势,比最快超算快13000倍
谷歌量子AI团队宣布里程碑式算法突破,其Willow芯片运行“量子回声”算法,首次在硬件上实现可验证量子优势,执行特定任务比最快超算快13000倍,为多领域应用铺平道路。
AI Agent接管谷歌搜索!预订餐厅、定制搜索结果,一键搞定所有事
今天凌晨谷歌宣布,谷歌搜索AI模式新增AI Agent功能,可自动预订餐厅、定制搜索结果。该功能用了自研Project Mariner实时网络浏览能力,以英语扩展到180多国,还将拓展更多领域。
ICCV 2025 | 机器人自主探索未知复杂空间?GLEAM破解主动探索建图的泛化难题
文章聚焦机器人在未知复杂空间的自主探索建图难题。香港中文大学与上海人工智能实验室联合提出GLEAM,搭建GLEAM - Bench基准,设计通用策略,实现零样本适配未知空间,在多指标上超越先前方法。