生成式推理」共找到 4258 篇相关文章

新闻资讯7

大模型的新战场在推理?——《推理模型综合测评报告 2025》深度解析 | 直播预告

5月29日,InfoQ研究中心发布《推理模型综合测评报告2025》,通过五大维度、五大题型的300道测试题对八家主流推理模型全面测评,还总结各维度表现,梳理技术前置因素与趋势。6月6日有直播解读。

InfoQ
算法论文8

细粒度视觉推理链引入数学领域,准确率暴涨32%,港中文MMLab打破多模态数学推理瓶颈

香港中文大学MMLab团队发布MINT - CoT视觉推理方案,解决多模态数学推理难题。它引入特殊Interleave Token,构建专属数据集,采用三阶段训练策略,实验效果全面超越现有方法。

量子位
算法论文8

EMNLP 2025 | 动态压缩CoT推理新方法LightThinker来了

随着AI发展,大语言模型处理复杂推理任务能力提升,但推理产生大量中间步骤和文本,拖慢计算速度、增加资源压力。研究者提出LightThinker,模仿人类思考模,动态压缩推理步骤,削减tokens数量,降低成本。

机器之心
开源动态8

多人会话视频生成新突破:香港科技大学,浙江大学用单人数据实现多人交互视频生成

香港科技大学、浙江大学等开源 AnyTalker,提出音频驱动多人交互生成新范。它用创新机制和两阶段训练策略,以少量数据实现多人视频生成,还构建评估指标,性能超现有方法。

AIGC开放社区
产品应用8

华为曝光两大黑科技!打破推理延迟魔咒,大模型从此「秒回」

华为通过FusionSpec和OptiQuant两大技术创新,对MoE模型进行推理优化。FusionSpec依托昇腾特点,将投机推理框架耗时降至1ms;OptiQuant支持灵活量化,为大模型推理提供高性价比。

新智元
产品应用8

每一幕皆可控!字节发布多主体视频生成神器,人人皆主角

字节发布多主体视频生成神器MAGREF,基于一张参考图像,能生成主体高度一致的视频,多人同台也不串脸。它采用三阶段数据处理流程,构建在DiT架构上,实现复杂视频生成任务。

量子位
算法论文8

知识类型视角切入,全面评测图像编辑模型推理能力:所有模型在「程序性推理」方面表现不佳

东南大学等团队提出KRIS - Bench,从知识类型视角对图像编辑模型推理能力评测。它分三大知识范畴、细化多种任务,设四维度评估指标,测10款模型,发现模型程序性推理等能力不足。

量子位
新闻资讯8

再封神!OpenAI掀翻AI图像生成,极度逼真,立刻商用

网传OpenAI的GPT-image-2正在灰度测试,韩国网友测试后称其生成图像可‘立刻商用’。它深度融合GPT大语言模型,生成照片更逼真,强化了提示遵循和场景理解能力,让AI图像生成进入‘实用时代’。

AIGC开放社区
新闻资讯7

老黄200亿「钞能力」回应谷歌:联手Groq,补上推理短板

谷歌TPU威胁刚至,英伟达砸200亿美元联手Groq布局AI新时代。知名投资人指出Groq LPU推理速度远超GPU、TPU等,但内存容量小。英伟达借此补推理短板,入局竞争激烈的推理市场。

量子位
算法论文7

DreamArt!只需一张图,生成可动的可交互物体

生成可动物体是具身智能等领域关键挑战,现有方法有局限。北大团队提出DreamArt框架,从单张图像生成可交互可动物体,经三阶段流程,表现优于基线方法,不过也存在生成不符物理规律等问题。

带你学AI