等变建模」共找到 8367 篇相关文章

算法论文8

思维链可无限延伸了,MIT打破大模型上下文天花板

MIT机构提出新架构Thread Inference Model(TIM),配合专用推理引擎TIMRUN,把推理过程为树状递归子任务结构并修剪子任务,让模型突破输出窗口限制实现长程推理,实验验证了其性能。

量子位
算法论文8

为什么给机器人装上昂贵的触觉传感器,反而让它笨了?

伊利诺伊大学香槟分校多校合作研究发现,当前机器人学习主流的多传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据会使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。

机器之心
新闻资讯8

工业异常检测新突破,复旦多模态融合监测入选CVPR 2025

复旦大学机构联合发布高精度多模态数据集Real - IAD D³,提出多模态融合检测方法D³M,成果被CVPR 2025收录。该数据集含多类数据,提升检测性能,此前相关工作也被CVPR 2024收录。

量子位
新闻资讯7

突发!Anthropic禁止中国控股公司使用Claude,无论公司在哪都不行

9月5日,Claude开发商Anthropic发布公告,停止向多数股权由中国资本持有的集团或子公司提供Claude服务,无论运营地点在哪。此举涉及法律、监管和安全风险,也适用于俄、伊、朝国实体。

AI科技大本营
算法论文8

揭开大模型“伪遗忘”,港理工团队:结构不就是没忘

近年来大语言模型隐私风险受关注,机器遗忘技术应运而生。港理工团队构建表示空间诊断工具,区分‘可逆性遗忘’与‘不可逆遗忘’,揭示遗忘现象背后表示结构化规律,还做了相关实验并得出核心结论。

量子位
算法论文8

推理正确率下降65.5%!斯坦福、MIT用「不式」拷问AI逻辑极限

大语言模型在数学证明常现推理漏洞,斯坦福高校团队提出IneqMath基准评估其严谨性。用不式证明题切入,拆解为子任务,构建评测体系,用LLM - as - Judge审查。结果显示模型推理正确率低,存在结构性缺陷。

新智元
算法论文8

CVPR 2025 多模态大一统:斯坦福 x 复旦提出符号主义建模生成式任务

来自多机构研究团队提出基于符号化表征的生成任务描述框架,将符号化思维引入生成任务建模。实验证明,该框架在跨模态生成任务中表现出色,为推进生成式人工智能能力提供了成本效益高且可扩展的基础。

机器之心
算法论文8

北航领衔发布300页代码智能综述:从基础模型到智能体,一次读懂Code LLM全景图

北航领衔联合近30家机构撰写《From Code Foundation Models to Agents and Applications》,系统梳理代码智能领域,串联模型、任务成完整技术链路,还通过实验给出实践指南。

量子位
算法论文7

微软提出「模型链」新范式,与Transformer性能相当,扩展性灵活性更好

随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软研究者提出 CoR 概念,构建模型链学习范式,应用于语言模型得 CoLM 系列,实验显示其性能相当且扩展性、灵活性更好。

机器之心
开源动态8

视觉强≠能干活!清北普林斯顿开源WorldArena,世界模型评测被颠覆

2026 年 2 月 13 日,清华、北大顶尖机构联合推出的 WorldArena 面向全球开源。这是首个‘功能 + 视觉’统一评测体系,撕开了‘美丽视频’伪装,让评测从‘审美导向’走向‘功能导向’。

机器之心