空间理解能力」共找到 4095 篇相关文章

算法论文8

Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存?

普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。

机器之心
产品应用7

纳米 AI 梁志辉:超级搜索智能体是 AI 时代的真正入口

纳米AI梁志辉认为超级搜索智能体是AI时代真正入口。纳米AI推出的「超级搜索智能体」结合多Agent协作等能力,是新解决方案。演讲分享了360对AI搜索、智能体搭建及浏览器的看法与探索。

Founder Park
产品应用7

百度在 AI IDE 上的决心

百度发布国内首个多模态、多智能体协同的AI IDE:Comate AI IDE。其功能完备,百度在AI IDE赛道决心大。随着模型和Agent能力提升,百度认为未来IDE竞争本质是Agent竞争,其早有相关布局。

MacTalk
算法论文8

田渊栋:连续思维链效率更高,可同时编码多个路径,“叠加态”式并行搜索

AI大牛田渊栋团队利用连续空间“叠加态”让大模型并行推理,提升图可达性等任务表现,为连续思维链提供理论支持。还设计注意力选择器等机制,实验显示连续思维链模型准确率更高。此外,田渊栋还是科幻小说家。

量子位
推荐文章7

图解Vllm V1系列6:KVCacheManager与PrefixCaching

文章聚焦vllm v1,阐述调度器取请求时判断设备有无充足空间做推理的问题,涉及KVCacheManager与Prefix Caching。前者管理请求和块,后者通过找最长一致前缀节省显存,还介绍块分配释放策略与流程。

GiantPandaLLM
算法论文7

无需人类插手!AI战队自主进化,人类玩家瑟瑟发抖

论文《Agents of Change: Self - Evolving LLM Agents for Strategic Planning》以桌游《卡坦岛》为“考场”测试AI战略能力。研究团队设计四代AI特工,实验显示能自我进化的AI完爆静态AI,不过也存在计算成本高、依赖基础模型等问题。

深度学习自然语言处理
开源动态8

LeCun世界模型出2代了!62小时搞定机器人训练,开启物理推理新时代

Meta开源发布V-JEPA 2世界模型,图灵奖得主Yann LeCun称其将为机器人技术带来新时代。该模型能理解物理世界,经训练后在多方面表现优异,Meta还发布新基准测试,也透露了后续计划。

量子位
算法论文7

一招缓解LLM偏科!调整训练集组成,“秘方”在此 | 上交大&上海AI Lab等

上海交大和上海AI Lab联合团队提出IDEAL方法,可提升LLM综合性能。研究发现SFT阶段数据数量非关键,配比不当会加剧模型“偏科”。以Llama3.1 8B测试,IDEAL能提升代码能力,还指导了超参数选取。

量子位
产品应用7

1.93bit版DeepSeek-R1编程超过Claude 4 Sonnet,不用GPU也能运行

1.93bit量化后的DeepSeek - R1(0528)编程能力超Claude 4 Sonnet,在aider榜单获60分。Unsloth工作室制作9个量化版本,小版本不用GPU也能跑。R1 - 0528在游戏评测中表现也佳。

量子位
新闻资讯8

双重突破:全球首个零售VLA大模型来了!开源OpenWBT让机器人遥操门槛暴降!

2025北京智源大会上,银河通用机器人展示端到端具身大模型GroceryVLA,可在商超场景自主操作,具强适用性等五大能力。还发布OpenWBT开源系统,降人形机器人遥操门槛,促产业发展。

量子位