「多场景预测」共找到 5672 篇相关文章

算法论文8

CVPR 2025 Highlight | 提升自回归模型样例学习能力,Few-shot图像编辑新范式开源

当前图像编辑模型在处理新概念时泛化能力不足,为解决此难题,Meta等研究者提出自回归模型InstaManip,创新性提出分组自注意力机制和关系正则化策略,在few - shot图像编辑任务上取得优异效果。

机器之心
算法论文8

中国团队让AI拥有「视觉想象力」,像人类一样脑补画面来思考

上海交通大学等团队提出 Thinking with Generated Images,让大模型像人类一样用「脑内图像」推理。该研究区分三种视觉思维模式,提出核心技术框架,解决视觉推理局限,实验效果好,未来有望在多领域突破。

机器之心
推荐文章7

彻底说清 Human-in-the-Loop:企业级 Agent 系统的关键挑战与LangGraph解法【上】

文章围绕企业级Agent系统中Human-in-the-Loop(HITL)展开,介绍其必要性、常见模式,以LangGraph为框架解读关键挑战与实践,涵盖核心机制、原理解析,还阐述HITL下工具调用的两种管控模式。

AI大模型应用实践
算法论文8

扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧

上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量。

量子位
推荐文章7

Dify、n8n、扣子、Fastgpt、Ragflow到底该怎么选?超详细指南来了。

文章从实用角度出发,对Dify、Coze、n8n、FastGPT和RAGFlow五款主流平台进行详细功能对比,结合真实使用体验和应用场景,为不同需求者提供选择指南,还给出选型考量要素。

数字生命卡兹克
新闻资讯7

对话阶跃星辰段楠:“我们可能正触及 Diffusion 能力上限”

阶跃星辰段楠指出当前视频生成技术或触天花板,真正有深度理解能力的模型尚待突破。他预测未来1 - 2年视觉领域基础模型有望出现,还分享视频生成及多模态AI未来核心洞察。

AI科技大本营
算法论文8

PITT | 提出PhyT2V框架:让文生视频(T2V)更符合物理规律(CVPR2025)

当前T2V技术迈向推理驱动阶段,物理规律是关键约束。匹兹堡大学团队提出PhyT2V框架,不依赖模型重训练或大规模外部数据,可增强主流T2V模型能力,有低落地门槛和良好泛化性。

AINLPer
开源动态8

千问3:开源第一不只是说说!

英伟达新开源的OpenCodeReasoning系列选千问作基础底座。千问3以Apache 2.0发布后,开发者生态更新频繁,衍生模型超10万,下载量破3亿,全球第一。其性能强,正加速开启全栈式AI时代。

探索AGI
新闻资讯9

三榜第一,完胜GPT-6!中国物理RSI杀出黑马

中国AI公司诺因发布面向家庭机器人的生成式学习框架GLOW,以原生自回归架构+RSI递归自我改进机制,在三大机器人任务榜单拿下第一,性能远超GPT-6 Astra,主打人类示范一遍就能泛化执行,计划明年推出家庭机器人X1。

新智元
产品应用9

乐享以太大模型,让中国具身智能坐上定义席

本文围绕乐享科技推出的以太大模型展开,指出当前具身智能主流VLA、WAM路线均存在固有缺陷,以太大模型改用能量驱动的求解范式,经开放烧烤直播测试验证其能力,开辟Physical AI新路径,推动中国具身智能突围。

AI科技评论