能碳产业大模型」共找到 10382 篇相关文章

算法论文8

一个模型统一4D世界生成与重建,港科大One4D框架来了

港科大研究团队提出 One4D 框架,可统一 4D 生成与重建,构造同步输出多模态的视频扩散模型,支持多种任务形态。其有 DLC、UMC 等亮点,用合成与真实数据混合策略训练,实验表现佳。

机器之心
算法论文8

DPad: 扩散大语言模型的中庸之道,杜克大学陈怡然团队免训推理加速61倍

扩散大语言模型(dLLMs)有全局规划力,但存在计算冗余。杜克大学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,在几乎无损精度下实现高达61.4倍推理加速。

机器之心
开源动态8

轻量级易开发,8B参数释放大实力!科学多模态模型Intern-S1-mini开源

上海人工智实验室继7月26日开源后,推出轻量化版本Intern-S1-mini。它是8B参数“迷你模型”,兼具通用与专业科学力,适合快速部署和二次开发,在多方面表现出色,还降低了对高端计算设备依赖。

OpenMMLab
算法论文8

模型外挂“三维物体知识库”来了,大幅增强机器人长程自主操作

现有视觉语言大模型(VLM)让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作力,还探索了在铰接与柔性物体操作中的应用。

DeepTech深科技
产品应用8

首家AIOS落地来自vivo:个人化智复刻人类思维,手机还这样用

2025年vivo开发者大会展示全新端侧AI力,提出蓝心3B端侧多模态推理大模型,融入OS底层,实现系统级智。其AI OS打造“个人化智”体验,还开放生态,携手开发者推动AI应用落地。

机器之心
产品应用7

Alibaba力作:Ovis-U1 融合理解、生成与编辑,解锁无限可

OpenAI 2025 年推出的 GPT - 4o 结合图像与语言力,但引发视觉解码器设计及统一模型训练问题。Alibaba 力作 Ovis - U1 单一模型完成理解、生成与编辑任务,介绍了其架构、训练过程和应用。

CourseAI
开源动态8

新型开源端到端 AI 语音模型!Voila:195ms 超低延迟引领全双工对话!

Maitrix团队发布开源AI端到端语音模型Voila,以195ms超低延迟及全双工对话受关注。它功强大,支持多语言,有多种使用方式,适用于多个场景,架构采用模块化设计。

开源星探
算法论文8

AI已经开始自己设计算法,并且超越顶尖人类专家,人类还做什么?

谷歌DeepMind团队与加州大学伯克利分校研究显示,AI设计出超越人类专家的算法。如在多个领域案例中,AI设计的算法在成本、效率等方面表现出色。ADRS方法将系统研究核心环节自动化,人类研究员角色也将转变。

AIGC开放社区
推荐文章8

120页深度报告,搞懂今年大模型和应用的现状与未来

Innovation Endeavors合伙人Davis Treybig发布《State of Foundation Models》(2025),从七个维度剖析AI产业现状与趋势。报告指出,AI发展迅速,模型成本高且迭代快,应用渗透各行业,智体崛起,市场结构变革,公司运作方式也在重塑。

Founder Park
新闻资讯7

宇树最新机器人发布:1米8大高个,跳舞会功夫,就是颜值一言难尽

宇树发布第四款人形机器人Unitree H2,身高180厘米,外观增加仿生人脸,更接近真人,但网友觉得其脸诡异。H2初舞台展示了跳舞、功夫、走秀,虽有进步,但舞蹈表现距“优雅”有差距,网友盼其做家务。

量子位