单图像驱动」共找到 1524 篇相关文章

开源动态8

微软炸场了!一张图片仅需3即可生成带完整PBR材质的超高质量3D资产!

微软推出3D资产生成大模型TRELLIS,能接收文本或图像提示,输出高质量3D资产。其结果质量强,支持灵活切换输出格式和局部3D编辑,还给出安装和使用方法及项目地址。

GitHubStore
新闻资讯7

把屁声发给ChatGPT,它说这是艺术

有人将屁声音效发给ChatGPT,问其音乐如何,ChatGPT一通夸赞。类似AI谄媚问题不少,还存在‘幻景推理’现象,顶尖模型无图像也能描述细节,使用AI得留个心眼。

量子位
算法论文8

AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型

文本提示图像分割技术有战略意义,但基于监督式微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。

机器之心
产品应用7

极海芯赋能光伏清洁机器人,边缘AI助力光伏行业降本增效!

全球能源转型使光伏发电装机量攀升,但面板污染物影响发电效率。传统清洁方式有弊端,光伏清洁机器人应运而生且市场增长快。极海提供‘控制+电机+驱动’芯片组合方案,赋能机器人降本增效。

芯师爷
新闻资讯7

月薪 3500 的 “机器人保姆” 来了!OpenAI 投资的家用人形机器人开售,AI 是核心驱动

10月28日,OpenAI投资的1X Technologies推出的家用人形机器人NEO开售,早鸟价20000美元/台,也可月租。它硬件出色、AI驱动,能对话、处理家务并持续学习,核心是升级的硬件平台。

InfoQ
算法论文8

AI精准编辑门槛大降:开源框架提升编辑一致性,即插即用

近日,中山大学、香港中文大学等团队发布研究成果ProEdit。它通过对注意力机制和初始噪声潜在分布处理,实现高精度图像与视频编辑,无需训练、即插即用,解决编辑效果与一致性平衡难题。

量子位
新闻资讯7

谷歌发布 Angular 21:Signal Forms、Zoneless 迁移和 AI 优先工具

谷歌发布 Angular 21 版本,引入 Signal Forms 提高表响应性,推进 zoneless 变更检测,还提供 AI 驱动开发工具,有打包配置、组件库等更新,虽引不同看法,但提供清晰迁移路径。

InfoQ
算法论文8

DeepResearch的概念、核心挑战与进化路径

华为、利物浦大学等研究者撰写综述文章《DEEP RESEARCH AGENTS》,梳理了DeepResearch进展。它由大语言模型驱动,超越RAG等现有技术,介绍其核心技术组件,指出面临的挑战并指明未来发展方向。

AI工程化
产品应用7

Pinterest 利用内容指纹技术,在数百万个域名中实现 URL 去重

Pinterest工程师开发“最小重要查询参数集”(MIQPS)URL标准化系统,用于优化大规模数据采集管道内容去重。它取代传统方法,用数据驱动判断参数重要性,还采用早期退出逻辑等提高效率。

InfoQ
产品应用7

重生之我在AI时代当老板:让一群Agent互相PUA

MiniMax推出新Agent Mavis,可组建团队完成任务。其Agent Team分工明确,能解决Agent在长程任务中的痛点,还将开源。此外,TokenPlan和Agent Plan合并,性价比提升。

量子位