「混元3D世界模型1.0」共找到 9089 篇相关文章
真·QQ飞车!「电动版F1」上海开赛,Gemini在线解说
Formula E电动方程式赛事和Gemini深度合作,Gemini承担直播解说、Driver Agent分析数据及驾驶指导功能。FE规则类似游戏,其技术或下放到普通汽车,不过自动驾驶发展下,FE未来是否需要人类存疑。
开源不到一天1.9k星星!NVIDIA新突破,机器人ChatGPT时刻!
NVIDIA开源ProtoMotions3框架,用经典自回归预测和物理仿真,让高级行为涌现。它能助力机器人多方面学习,有望降低人形机器人开发门槛,虽处研究阶段,但提出新思路。
刚刚开源不到1MB大小,每个AI程序员都该装!
当跑多个 AI Agent 时,很难第一时间了解每个 AI 状态。刚开源的 `abtop` 项目运行在终端,能实时展示 Claude 和 Codex 会话状态,不依赖 API Key,功能实用且安装方便。
单任务狂飙16小时!模型+Harness双轮驱动,金融Agent跑通了
2026年AI圈热词Harness成Agent产品基础设施。通用Harness难适配金融订单,易鑫首席科技官贾志峰将开源自研Harness Framework,采用三层驾驭体系,实测效果佳,成本低。
OpenClaw现在可以直接生成视频了,支持12家视频模型提供商
Peter Steinberger宣布OpenClaw新版推视频生成功能,让Agent完成文本到视频流程。它集成12家视频生成提供商,异步生成,使用简单,支持丰富参数配置,官方文档见https://docs.openclaw.ai/tools/video-generation 。
科研数据不再碎片化!一张可计算图,连起整个科研世界
UIUC研究团队打造ResearchArcade,将ArXiv论文、OpenReview评审等碎片数据连接成动态知识图谱。它有多源、多模态等特征,支持多种格式数据导入导出,定义了六个任务,验证了图结构在科研数据处理中的作用。
AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型
文本提示图像分割技术有战略意义,但基于监督式微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。
微软AI新天团曝光!只有1位华人,「谷歌系」超1/3
微软AI CEO苏莱曼领导的17名核心高管阵容曝光,新增9名核心成员中有5位来自谷歌(包含DeepMind)系,8名老将中有2名来自苏莱曼共同创办的Inflection AI。新核心团队将聚焦AI产品落地、安全与隐私、增长与商业化。
ICLR 2026惊现SAM 3,分割一切的下一步:让模型理解「概念」
9月12日,匿名论文‘SAM 3: SEGMENT ANYTHING WITH CONCEPTS’登陆ICLR 2026,外界猜测出自Meta。SAM 3定义了可提示概念分割任务,性能比之前系统提升至少2倍,在多基准测试获SOTA成绩,但也有人质疑是旧概念包装。
开源|Python 应用往微服务迈进的 1*3 种 Pythonic 步伐
在微服务架构主流的当下,Java凭成熟生态占主导,Python开发者面临尴尬。为此开源了`nacos-serving-python`项目,介绍全新Python微服务解决方案,涵盖服务发现策略、三种自动注册方式等内容。