复杂推理任务」共找到 4030 篇相关文章

开源动态8

自回归因果注意力也能并行解码?上交联合UCSD突破LLM推理瓶颈,模型代码全开源

大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。

机器之心
新闻资讯8

通用Agent是伪命题?昆仑万维方汉现场拆解:垂直推理才是胜负手|新智元十年峰会

在新智元十周年峰会上,昆仑万维董事长方汉分享公司转型故事与多模态AGI见解。他认为通用Agent非万能,垂类推理数据是关键,还提出AI商业落地逻辑,展示多款产品成果。

新智元
算法论文8

模拟大脑功能分化!北大与港中文发布Fast-in-Slow VLA,让“快行动”和“慢推理”统一协作

北大与港中文研究团队发布 Fast-in-Slow(FiS-VLA)全新双系统视觉 - 语言 - 动作模型,将快速执行模块嵌入预训练视觉 - 语言模型,实现快慢系统一体化。该模型在多平台表现优异,控制频率大幅领先。

机器之心
新闻资讯7

CVPR 2026 Workshop征稿|从感知到推理,ViSCALE 2.0 邀你重塑计算机视觉的 System 2

2026年6月,CVPR第二届计算机视觉推理扩展研讨会(ViSCALE 2026)将在美国回归。由顶尖机构学者联合举办,将汇聚顶尖学者探索视觉模型突破瓶颈之法。会议亮点多,还开启论文征稿,欢迎积极投稿。

机器之心
开源动态8

让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解长时记忆与交互瓶颈

上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。

量子位
算法论文8

突破高分辨率图像推理瓶颈,复旦联合南洋理工提出基于视觉Grounding的多轮强化学习框架MGPO

先进多模态大模型处理高分辨率图像有瓶颈,复旦和南洋理工研究者提出基于视觉Grounding的多轮强化学习方法MGPO,能让模型精准推理,还可使模型从答案反馈中涌现视觉定位能力,避免依赖昂贵标注。

机器之心
算法论文8

攻克AI过度思考难题!美团新研究让通过“可验证”过程奖励激活LRM的高效推理

美团等机构研究团队针对LRM“过度思考”问题,提出可验证的过程奖励机制(VSRM)。它结合可验证奖励与步骤级奖励,为推理步骤分配奖励信号。实验显示其能降低输出长度并保持性能。

量子位
开源动态7

可从表复杂文档中提取结构化数据的Python库agentic-doc,支持100+页PDF长文档

LandingAI的Agentic文档提取API可从复杂文档提取结构化数据,Python库agentic-doc封装该API,支持100+页PDF长文档,有自动重试、并行处理等功能,还能可视化调试。

GitHubStore
开源动态8

攻克大模型「表格盲区」!ST-Raptor框架发布,实现复杂半结构化表格的精准理解与信息抽取

半结构化表格布局多样、结构复杂,让自动化数据处理困难。上海交大等团队发布 ST - Raptor 框架,提出 HO - Tree 数据结构及树上操作,构建 SSTQA 数据集,提升表格问答准确率,弥补大模型处理短板。

机器之心
算法论文8

ICCV 2025 | 打造通用工具智能体的基石:北大提出ToolVQA数据集,引领多模态多步推理VQA新范式

北大团队提出ToolVQA数据集,用于提升基础模型工具使用能力。它含2.3万条样本,贴近真实需求。通过ToolEngine构建,涵盖多工具与任务领域。微调后模型表现佳,代码与模型已开源。

机器之心