大世界模型」共找到 9357 篇相关文章

产品应用7

Cursor发布首个编程模型!代码生成250tokens/秒,强化学习+MoE架构

Cursor 2.0正式发布,搭载自研模型Composer。它30秒完成复杂任务,比同行快400%,每秒生成250个tokens。还带来原生浏览器工具等新功能,基于强化学习,但模型底子透明度遭质疑。

量子位
新闻资讯7

315曝光的“AI投毒”原理:GEO这样操控模型推荐

央视3·15晚会揭开AI“投毒”灰色产业链,利用GEO操控模型推荐。介绍了训练数据污染、检索上下文劫持、提示注入诱导攻击三种“投毒”技术,还阐述了内容生产、渠道投放、效果强化的产业链运转流程。

量子位
算法论文8

多模态模型持续学习系列研究,综述+Benchmark+方法+Codebase一网打尽!

近年来,生成式AI和多模态模型进展显著,但在动态环境下实现持续学习是挑战。中科院自动化所联合香港院AI中心系统性研究,提出综述、方法、Benchmark和Codebase,为相关人员提供全面支持。

机器之心
算法论文8

ICML 2026 | 只用少量Thinking Tokens,模型依然能深度思考

近年来,CoT 推理成为提升模型复杂问题求解能力的重要路径,但带来效率问题。浙江学等团队提出 Heima 框架,将冗长 CoT 压缩为少量 thinking tokens,在减少 token 数的同时保留推理能力,已被 ICML 2026 接收。

机器之心
算法论文8

LLM-in-Sandbox:给模型一台电脑,激发通用智能体能力

来自中国人民学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
开源动态8

LeCun预言成真!790年长视频,炼出最强开源「世界模型

2025年‘世界模型’成AI巨头战场,谷歌、李飞飞团队等纷纷布局。上周北京智源研究院发布Emu3.5,340亿参数,基于790年长视频数据训练,其架构优越,推理快,能力强,还公开技术报告邀全球探索。

新智元
算法论文8

推理路径的动态调控:让模型学会“恰到好处”的思考

当前模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。

深度学习自然语言处理
新闻资讯8

逛完世界机器人会,我们发现了四趋势|甲子光年

2025世界机器人会8月8日在北京开幕,有200余家企业参展。甲子光年总结四趋势,如激光雷达厂商入局、人形机器人进厂、VLA模型异军突起、仿生机器人走入现实,预示机器人产业走向实战。

甲子光年
算法论文8

世界模型最新综述!中科院联合MBZ、NTU、Oxford系统梳理前沿进展

中科院联合多机构及顶尖学者合作,系统梳理世界模型建模范式、方法等,归纳为四分支,还梳理其在多领域应用、基准数据集等,讨论走向通用智能面临的障碍。

机器之心
算法论文8

上海交DENG Lab提出「LatentUM」:Unified Model的真正「战场」在视觉推理与世界模型

上海交通学 DENG Lab 提出的 LatentUM,尝试让统一模型把生成的视觉内容纳入推理闭环。它在多项任务上超越基线,其核心思路是生成与语言共享语义空间的离散 visual semantic tokens,模型含三关键设计。

机器之心