图像结构纹理」共找到 939 篇相关文章

新闻资讯7

稚晖君和王兴兴,打起了人形机器人关键一仗

科技圈风口聚焦人形机器人,宇树科技和智元机器人争夺“人形机器人”第一股。两者虽产品线和应用场景有共性,但商业化进程、战略打法和组织结构差异大,代表不同具身智能发展路径。

芯师爷
开源动态8

智源新出OmniGen2开源神器,一键解锁AI绘图「哆啦 A 梦」任意门

2024年9月智源研究院发布统一图像生成模型OmniGen,获社区好评。近期OmniGen升级为OmniGen2,增强多方面能力且全面开源。它采用新架构与策略,有反思机制,玩法丰富,还推出新基准优化部署。

机器之心
推荐文章7

被骂“在乱讲”的专家,这次可能说对了:传统数据仓库正在被 Agentic AI 吞噬

作者认为AI浪潮影响软件生态,Agentic AI时代下,传统数据仓库和复杂ETL链路将被重新设计甚至消失,其偏重结构与查询模式会被Agentic Data Stack架构强调语义与响应模式取代。

InfoQ
算法论文8

用大模型检测工业品异常,复旦腾讯优图新算法入选CVPR 2025

AI模型用于工业异常检测获新SOTA,相关论文中稿CVPR 2025。复旦大学、腾讯优图实验室等机构研究人员设计基于扩散模型的少样本异常图像生成新模型DualAnoDiff,实验显示其性能更优。

量子位
新闻资讯7

CVPR 2025 Tutorial:从视频生成到世界模型 | MMLab@NTU团队&快手可灵等联合呈现

图像生成普及,视频生成也有高质量发展,可灵、Sora等模型不断拓宽边界。CVPR 2025 Tutorial将探讨视频生成能否成世界模型桥梁、具身智能核心能力等问题,汇聚一线研究者分享。

量子位
算法论文8

中国团队让AI拥有「视觉想象力」,像人类一样脑补画面来思考

上海交通大学等团队提出 Thinking with Generated Images,让大模型像人类一样用「脑内图像」推理。该研究区分三种视觉思维模式,提出核心技术框架,解决视觉推理局限,实验效果好,未来有望在多领域突破。

机器之心
开源动态7

任何错误只犯一次:TencentDB Agent Memory 的团队记忆实践

文章聚焦 TencentDB Agent Memory 的团队记忆实践,从组织协作现状出发,阐述其原理、结构、构建方法,通过多方面测试验证其价值,提炼出设计原则,指出其核心是治理系统,目标是提升协作带宽。

腾讯技术工程
算法论文8

竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

大语言模型在竞赛编程场景易失败。南大、清华等研究者提出Solvita框架,由四个角色形成闭环,构建可训练图结构知识网络积累经验。实验显示其在多评测中表现强,提升不靠增加token。

新智元
产品应用7

分享一个 Skill:如何找到值得做的创业 idea

作者分享找创业想法的方法,认为AI时代想法重要性回归。介绍通过AI获取各平台信号,还推荐Tabbit浏览器,其能创建复用妙招扫描机会,给出结构化清单,还可定时执行,有共享社区。

AGI Hunt
推荐文章8

Agent Skill规范、构建与设计模式

文章深入解析 Agent Skill 的规范、构建与设计模式。介绍了 Skill 规范标准、三层渐进式加载机制和触发机制,阐述了 Skill-Creator 和 Writing-Skills 的核心思想,还总结了 Google 的 5 种 Skill 设计模式,最后指出 Skill 生态已形成完整知识体系。

阿里云开发者