图构建」共找到 2177 篇相关文章

推荐文章8

11篇顶会论文之外,美影像研究院做了一件事:让大众爱用AI

过去两年,AI 生成片、视频变得容易,但让 AI 理解并按创作者意创作很难。美影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。

机器之心
算法论文8

通义团队提出环境Scaling:自动构建环境,并自主学习和成长,可让30B比肩1T效果

阿里巴巴通义实验室团队论文提出通过程序化、自动化构建模拟环境,让语言模型自主交互学习。基于此训练的AgentScaler模型,数十亿参数就达万亿级模型性能,为轻量级代理智能发展带来新可能。

深度学习自然语言处理
算法论文8

ICML 2026 Oral | 为3D空间智能数据构建全自动数据飞轮,Holi-Spatial打造400万级空间多模态数据集

来自多机构的研究团队提出 Holi - Spatial,可从原始视频自动生成 3D 重建等数据,构建 400 万级空间标注数据集 Holi - Spatial - 4M,提升 VLM 空间能力,还形成自动化数据飞轮,但存在计算成本高、特定场景表现不佳等局限。

机器之心
产品应用7

给 AI 一张陶罐碎片,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测

文章实测 MiniMax H3 和 Seedance 2.0 Fast,给模型一张破碎陶罐,让其生成破碎过程视频。分析 H3 技术逻辑,对比两模型效率、质感和物理细节等差异,指出开放与闭源模型的特点及视频模型待解决的问题。

AI科技评论
算法论文8

因果发现大模型迎来「理论破局」: DAG-FM 破解异质机制下的因果识别与涌现难题 | GAIR Paper 116

浙大、清华与稳准智能联合发布因果发现大模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。

AI科技评论
推荐文章7

如何让Agent更符合预期?基于上下文工程和多智能体构建云小二Aivis的十大实战经验

文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,从预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。

阿里云开发者
开源动态8

SD又回来了!一秒出,手机就能玩:SD3.5-Flash让专业AI绘画进入“闪电”时代

Stability AI联合萨里大学SketchX实验室推出SD3.5-Flash模型,能在普通电脑甚至手机上快速生成专业级高分辨率片。它将推理步骤压缩、显存要求降低、出时间大幅缩短,画质也没明显缩水,还在性能上反超SD3.5M。

AIGC开放社区
算法论文8

AI在实时视频里秒“剪”出你想要的部分!输入文字//视频片段,它都能秒懂|ICCV2025

最新混合模态在线视频定位技术OVG - HQ开挂了!它能根据文字、、视频片段等线索,在实时视频流中精准裁剪出关心的事件,已收录于ICCV2025,破局以往技术“离线”“词穷”缺陷。

量子位
开源动态8

5B参数+4060Ti,10秒出,全流程开源可复现!补齐统一多模态生成编辑的开源版,让高质量像生成真正变得更轻量、更普及

近日,多机构联合发布统一多模态生成编辑模型DeepGen 1.0,仅5B参数,集成五大能力,4060ti 16G上10秒出,多项指标超大4倍工业级模型。团队开源全流程代码与数据,可从零复现。

量子位
算法论文8

GraphRAG太慢LightRAG延迟高?华东师大新方法一招破解双重难题

华东师大李翔老师带领的Planing Lab团队推出E²GraphRAG方法,解决GraphRAG索引慢、LightRAG查询延迟高的问题。该方法用SpaCy识别实体,结合和树查询,在构建和查询时间上表现出色。

量子位