模块化生成策略」共找到 1133 篇相关文章

算法论文8

StereoAdapter:北大首提自监督,适配水下双目深度估计

水下机器人深度感知难题待解,北大等机构提出StereoAdapter框架。它结合单双目视觉,以自监督学习适配视觉基础模型到水下域,设计双阶段结构、自监督训练策略等,实验效果好,未来还将多方面改进。

新智元
新闻资讯7

中国机器人这么玩儿,把老外都整不会了

这两天,中国机器人把网上老外看傻眼。松延动力发布小机器人Bumi,售价9998元;本末科技推出全球首款整机模块具身智能机器人D - INFINITE,会功夫。此外,宇树H2等也引关注,中国机器人火出圈。

量子位
开源动态8

告别AI“乱画图表”!港中文团队发布首个结构化图像生成编辑系统

现有AI生图工具在结构化图像生成上问题多,理解与生成能力有鸿沟。港中文等校联合团队提出首个综合性方案,涵盖数据集构建、模型优化、评估基准三大模块,助多模态模型画准图,推动其发展。

量子位
推荐文章8

18 年 SEO 增长经验专家:别再收藏各种 AEO 最佳攻略了,自己动手实验才是做好的关键

18年SEO增长经验专家Ethan Smith与Lenny对谈,指出网上多数AEO信息不准确,做好AEO要自己动手验证。还分享AEO玩法、与SEO区别、优化策略等,强调100%AI生成内容不可行,要优化帮助中心内容。

Founder Park
算法论文8

混合数学编程逻辑数据,一次性提升AI多领域强化学习能力 | 上海AI Lab

上海AI Lab的OpenDataLab团队通过大规模实验剖析RLVR在多领域推理机制。构建多领域评估框架与定制奖励策略,基于Qwen2.5 - 7B系列模型联合训练,有多项关键发现,为构建AI推理模型提供参考。

量子位
新闻资讯7

GPT-5刚刚正式发布,首次面向免费用户开放

OpenAI正式发布GPT - 5,有架构统一、性能大幅提升、全用户开放三大核心变化。测试数据显示性能进步明显,采用新定价策略面向所有用户开放。但演示未带来突破感,编程能力还面临Claude Opus 4.1挑战。

AI工程化
开源动态7

强化学习+MCP=王炸?开源框架教AI在MCP中玩转工具解决任务,实测效果超越GPT!

科技公司OpenPipe提出全新开源强化学习框架MCP·RL,只需一个MCP Server地址,agent就能自动发现工具、生成任务,在闭环反馈中摸索出最优调用策略,实测在2/3的benchmark上达或超SOTA性能。

量子位
新闻资讯8

Anthropic CEO最新采访:AGI一词毫无意义、点名扎克伯格、谈开源、家庭……等八个非共识观点

Anthropic CEO Dario Amodei在采访中给出八个非共识观点。他认为AGI和ASI是空洞概念,年亏30亿美元是投资,开源作用被高估,还谈及公司应对挖角、竞争、市场定位等策略,展现独特领导风格。

AGI Hunt
开源动态8

Agent KB:经验池让Agents互相学习!GAIA新开源SOTA,Pass@1性能最高提升6.66

来自多家机构团队发布 Agent KB 框架,构建经验池实现 AI Agent 经验共享。在 GAIA 基准测试中表现出色,提升多模型 Pass@1 性能,还在软件工程领域展现价值。其设计精妙,经消融、检索策略等实验验证有效。

机器之心
产品应用8

千卡集群破壁之道:vivo视觉多模态大模型训练效率跃迁实战

多模态大模型在多领域需求增长,但千卡级 GPU 训练挑战大。vivo AI 架构师王兆雄在大会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。

InfoQ