视觉设计」共找到 1886 篇相关文章

新闻资讯8

Runway Gen-4.5刷屏发布,把重量、尘土和光影都做对了,网友:颠覆

Runway Gen-4.5突袭发布,获“视频生成AGI时刻”评价,在Artificial Analysis测试中拿下SOTA。它能精准执行复杂指令,物理还原与视觉精准度强,官方将逐步开放使用权限,还直言其存在因果推理等局限。

量子位
产品应用8

获NVIDIA致谢:悟空Agent的实践、复盘与迭代

本文以悟空Agent获NVIDIA致谢为切入点,介绍多智能体架构闭环及实战挑战,如上下文断流、调度失衡。还阐述架构设计、迭代优化、数据飞轮体系,指出AI infra存在安全隐患,强调安全融入业务的重要性。

腾讯技术工程
开源动态8

长达790年视频镜头,打造原生多模态世界模型!北京智源研究院用Emu3.5统一“世界”

北京智源研究院发布并开源基于原生多模态训练的世界学习者Emu3.5,它将视觉和语言视为同一种数据流,在超13万亿token数据上学习,解决长视野多模态信息处理问题,经多阶段训练和优化,能力强大且已开源。

AIGC开放社区
算法论文7

POF | 西北工业大学马榕池、高传强等:基于预解分析的圆柱绕流最优射流控制位置对雷诺数依赖性研究

本文提出预解分析有效增益指导控制位置量化设计方法,发现不同雷诺数下最优控制位置关系式,挖掘出射流与主流掺混作用的流动机理,即射流在科恩达效应有效行程内到分离点可最佳抑制涡脱。

力学与人工智能
新闻资讯7

4倍速吊打Cursor新模型!英伟达数千GB200堆出的SWE-1.5,圆了Devin的梦!实测被曝性能“滑铁卢”?

Cognition推出全新AI编码模型SWE-1.5,专为软件工程任务设计,运行速度快,在基准测试中成绩良好。它基于GB200芯片训练,有定制编码环境,开发有新战略,还与Cursor新模型Composer对比引发关注。

InfoQ
新闻资讯8

L4大方向有了:理想自动驾驶团队,在全球AI顶会上揭幕新范式

在全球计算机视觉学术顶会 ICCV 2025 上,理想汽车自动驾驶高级算法专家詹锟发表演讲,阐述了‘从数据到训练’的系统化思路,提出将世界模型与强化学习闭环落地于量产自动驾驶系统的完整架构。

机器之心
新闻资讯8

计算机科学家杰弗里·辛顿:“AI会让少数人更富,多数人更穷”

被誉为‘人工智能教父’的杰弗里·辛顿,见证了AI从学术走向主流。他从技术加速者变为警示者,指出AI或对人类造成严重伤害,还谈到应对风险方案、中国优势及AI对社会经济的影响等。

宝玉AI
算法论文8

港科广×腾讯联手打造《我的世界》神操作,400张截图就能让AI挖矿通关,成本降至5%|EMNLP 2025

港科广与腾讯联合团队提出VistaWise框架,将“跨模态知识图谱+轻量化视觉微调”引入开放世界智能体。实验显示其在“获取钻石”任务表现出色,成果被EMNLP 2025主会录用。该框架以低成本、跨模态为突破口。

量子位
产品应用8

全面拥抱AI Agent,从0到1动手用GPTBots搭建企业数字助理智能体,办公效率翻倍~

文章指出当下Agent/Agentic AI是热门风口,企业级智能体受资本追捧。重点分享运用GPTBots平台从0到1搭建企业数字助理智能体,涵盖架构、流程、设计、测试等内容,介绍选择该平台的原因及实践成功关键。

PaperAgent
算法论文7

高效大规模创新3D重建模型iLRM

多数基于Transformer架构的模型处理多视图输入有可扩展性问题,成均馆大学、延世大学研究人员提出创新3D重建模型iLRM。它通过迭代细化机制生成3D高斯表示,有独特架构设计和高效注意力机制。

AIGC开放社区