「元脑智能体工作站Z3」共找到 3940 篇相关文章
用2D先验自动生成3D标注,自动驾驶、具身智能有福了丨IDEA团队开源
IDEA团队张磊团队提出OVSeg3R开集3D实例分割学习新范式。它无需人工后处理和3D掩码标注,降低训练成本,有望让3D实例分割商业落地,可用于自动驾驶、智能家居等领域。
这波AI淘金热里,卖“铲子”的公司正闷声发财,“征服"了几十家国内外巨头!
光轮智能联合创始人杨海波表示,AI发展让合成数据需求增大。该公司为具身智能行业提供3D合成数据,服务众多头部企业。其优势在于技术视野与路径独特,强调物理交互、人类示范等。还谈及创业要点与AI赛道变化。
Sam Altman自曝羡慕20岁辍学生,还直言美国难以复制微信这类“全能App”!
当地时间2025年开发者日,OpenAI推出系列开发者更新,向通用智能平台转型。会后,CEO Sam Altman接受专访,谈及新工具影响、AGI突破、智能体发展等,还表示羡慕20岁辍学生,认为美国难复制微信“全能App”模式。
论文精选 | 以AI赋能力学:计算力学的智能化之路与未来图景
中国力学学会旗舰期刊AMS推出“力学前沿”专栏,首期解读“计算力学的智能化之路与未来图景”。文章介绍智能计算力学三大范式、面临挑战,还阐述重塑智能框架前沿方向,指出AI与计算力学融合是系统性重构。
独家|RoboScience 机器科学完成10亿元融资,资金将用于强化 VLOA 大模型与本体
AI科技评论独家消息,RoboScience机器科学近日完成10亿元A轮融资,将深化VLOA大模型技术,推进自研机器人本体工程化与量产。其VLOA大模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。
2025.7.4上午 | 视觉智能驱动的多模态对齐与推理的近期系列工作分享 - 复旦博士生王思尹
本次分享由复旦博士生王思尹围绕‘视觉智能驱动的多模态对齐与推理’展开,介绍多模态大模型探索研究,涉及跨模态组合语义理解、视觉参与推理及基于视觉建模世界完成行动等内容。
拥抱 AGI 时代的中间层⼒量:AI 中间件的机遇与挑战
文章指出大模型发展呈能力跃迁、生态开放趋势,推动AI应用从聊天机器人向组织级智能体演进。AI中间件可解决应用工程化挑战,但面临上下文管理、记忆更新等难题,短期助力应用规模化,长期或成组织智能“神经中枢”。
Meta亿元天团首个大模型交卷!余家辉宋飏Jason Wei耗时九个月,一雪Llama前耻
Meta超级智能实验室耗时9个月推出原生多模态模型Muse Spark,发布后股价拉升。它让Meta在第三方测评中赶上第一梯队,虽在编程和长时间自主运行有差距,但在多模态理解等方面表现突出,不过也有编程翻车情况。
清华姚班团队,开源具身智能视觉语言动作(VLA)模型工具箱,打造行业通用技术底座
清华姚班团队所在的原力灵机公司,开源了基于PyTorch的视觉语言动作(VLA)模型工具箱Dexbotic。它能打造通用底座,解决行业研发困境,其预训练模型表现出色,还与Hugging Face合作推出评测平台。
通用Agent是伪命题?昆仑万维方汉现场拆解:垂直推理才是胜负手|新智元十年峰会
在新智元十周年峰会上,昆仑万维董事长方汉分享公司转型故事与多模态AGI见解。他认为通用Agent非万能,垂类推理数据是关键,还提出AI商业落地逻辑,展示多款产品成果。