3D世界模型」共找到 8735 篇相关文章

开源动态8

英伟达GEAR实验室刚刚放出大招,物理世界的自动研究 AutoResearch 首次成为现实

英伟达GEAR实验室实现物理世界自动研究AutoResearch,其ENPIRE系统让8个Codex智能体接管机器人舰队自主完成研究流程,将高精度操作成功率提至99%,还发现新物理缩放法则,项目即将开源。

AI寒武纪
新闻资讯7

硅谷精英放弃生娃!MIT女记者揭秘:人类只是AI垫脚石,世界很快就毁灭

华人女记者Karen Hao出版《AI帝国》,揭露OpenAI背后隐秘真相。书中提到部分AI行业技术高管因认为世界不久将不复存在而选择不育,还讲述了AI带来的诸多问题,如资源消耗、道德困境等,也指出AI公司拒绝承担现实成本。

新智元
开源动态8

AI教母李飞飞空间智能开源大动作:上亿节点3D高斯场景塞进手机网页

AI教母李飞飞的空间智能公司World Labs开源3D高斯泼溅网络渲染器Spark 2.0,打破硬件与平台壁垒,将亿级渲染能力带到网页和移动端,解决Web端痛点,还采用三大核心技术系统及更多黑科技。

AI寒武纪
新闻资讯7

Meta详细阐述基于LLM级训练、混合并行计算与知识迁移的GEM广告模型

Meta发布生成式广告模型GEM详细信息,旨在改善平台广告推荐能力。它处理海量用户 - 广告交互数据,用三种方法构建系统,还实施GPU级优化,采用两种知识迁移策略,获业内人士认可。

AI前线
开源动态7

Dev Proxy v1.3.0:HAR 文件生成、LLM 使用跟踪、增强的 API 测试功能

Microsoft 365 开发团队发布 Dev Proxy v1.3.0 版,引入 HAR 文件生成、OpenAI 使用跟踪等新功能,改善调试、测试和 API 监控,还改进 OpenAPI 规范生成等,同时更新了 VS Code 工具包。

InfoQ
新闻资讯8

刚刚Gemini上新模型,全球只有7人比它会编程,谷歌姚顺宇参与

北京时间周五凌晨,谷歌发布Gemini 3 Deep Think重大升级,在多学术基准测试中取得佳绩,成本大幅降低,编程能力超多数人。在多科学领域表现出色,还推动了实际应用,已上线供部分用户使用。

机器之心
开源动态8

准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源可商用

近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里可被验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许可。

量子位
推荐文章8

科普向:一文解构大模型后训练,GRPO和它的继任者们的前世今生

文章深入解读大模型后训练,先对比 PPO 与 GRPO,指出 GRPO 优势及成本问题。又介绍 GRPO 后续改进算法,如 DAPO 解决训练问题、GSPO 提升训练稳定性、GFPO 可优化多属性,还提及 GRPO 其他缺陷。

机器之心
开源动态8

微软又上大分!刚刚开源一款 0.5B 轻量级实时 TTS 模型,还能边想边说!

2025 年大家致力于解决 AI「嘴巴」问题,追求实时流式对话。微软刚开源轻量级 TTS 模型 VibeVoice-Realtime - 0.5B,参数虽小但能边输入边朗读,有诸多特点和广泛应用场景。

开源星探
算法论文8

给文档质量"打分":DIQA-5000 数据集与融合版面语义的 DocIQ 质量评估模型

文档图像质量评估(DIQA)是评判‘增强算法有没有把图变好’的关键工具。过去研究多围绕自然图像,缺文档专用数据集。本文提出DIQA - 5000数据集和DocIQ模型,补齐缺口。

机器学习AI算法工程