多步聚合训练」共找到 5671 篇相关文章

算法论文8

结构化扩展拿下Agent工具检索新SOTA,精准找到API|ICLR'26

宁波东方理工大学沈晓宇团队在ICLR 2026发表论文,指出当前工具检索瓶颈在于工具文档。提出对文档结构化扩展,再训练模型的方案,构建TOOL - REX等组件,实验显示显著提升检索性能。

量子位
新闻资讯7

The Batch: 867 | 印度推动本土人工智能建设

印度在资金有限、语言与方言众情况下,正加倍努力建设本土大模型。政府资助初创企业、调配算力,家公司研发语言模型,虽面临挑战,但旨在开发符合自身需求的人工智能。

DeeplearningAI
开源动态8

不看后悔!GitHub 开源 MultiTalk .8k star 强大的人语音+图像绑定项目

MultiTalk 是 MeiGen‑AI 开发的开源框架,可从音频、图片和提示语生成人对话视频。它解决传统视频制作痛点,功能亮点,技术优势明显,应用场景广,与同类项目对比表现突出。

小华同学ai
开源动态8

终于开源升级OmniGen2,统一模态图像生成模型,真的惊艳。

OmniGen2是强大的开源统一模态图像生成模型,针对文本和图像模态构建独立解码路径,运用未共享参数。新架构提升处理效率和质量,在图像编辑等任务表现出色,还有技术特点。

开源AI项目落地
产品应用7

震撼好莱坞,一天AI生成10部短片,Google神器比肩一个影视工作室

Google的AI视频神器Veo 3刷屏,使用门槛低,生成效率高,效果震撼。它能生成二次元、科幻、仙侠等种类型短片,虽有不足,但极大促进AI视频发展,适合行业基层人员。

鲸选AI
产品应用8

业内首推“共享存储”,OceanBase何以办到?

5月17日,OceanBase在开发者大会推出“共享存储”产品,实现对象存储与事务型数据库深度集成,降低存储成本、提升弹性。它解决了传统架构瓶颈,靠项技术创新落地OLTP生产环境,适用于业务场景。

InfoQ
算法论文7

告别Reasoning模型的“灵光一现”,推理能力可控了

当前GPT - 4o、DeepSeek - R1等大模型推理的‘高级操作’随机触发,不可控。研究者受经典推理三要素启发,教会模型三种‘元能力’,经三阶段训练,模型效果提升,让推理能力可控。

深度学习自然语言处理
新闻资讯7

刚刚,北京建了一座AI工厂:目标10万P算力,日产10万亿Token!

九章云极在2026全球智算科技峰会发布AI工厂战略,含训练和Token工厂,目标10万P算力、日产10万亿Token。用DCU度量投入,Token度量产出,重构智能生产与交付体系,适配不同企业需求。

量子位
开源动态8

看看人家的项目,一行命令即搞定,优雅、好看!

开源君发现神器 Freeze,它由 Charm 团队开发,能将代码文件或终端输出渲染成图片,支持格式、高度定制,有交互界面,在 GitHub 获 4.4k Star,适合写博客、做分享的人。

开源先锋
新闻资讯8

神秘模型屠榜日、碾压Seedance 2.0!背后竟是阿里大招:新部门首作实锤,引爆股价拉升

近日,神秘模型 HappyHorse-1.0 登顶 Artificial Analysis 视频模型排行榜。阿里巴巴确认其为 ATH-AI 创新事业部自研产品,正在内测,4 月 30 日上线 API。该模型技术亮点,若开源或改变 AI 视频行业格局。

InfoQ