空间理解能力」共找到 4037 篇相关文章

新闻资讯8

刚刚,谷歌发布机器人最新「大脑」模型!思考能力SOTA,还能「跨物种」学习

谷歌旗下DeepMind发布Gemini Robotics 1.5系列模型,包括Gemini Robotics 1.5和Gemini Robotics - ER 1.5,能让机器人学会‘思考’,还可跨具身形态学习技能,有望开启通用机器人新时代。

新智元
开源动态8

表格理解新纪元!上交大等联合开源,半结构化表格问答准确率提升40%!

数据密集型工作中半结构化表格处理难,传统工具和GPT - 4o表现不佳。上海交通大学等联合开源ST - Raptor,通过VLM、HO - Tree算法和LLM推理,解决复杂表格问答问题,支持多格式,适用于多场景。

开源星探
算法论文8

大模型训练新突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了大模型训练的数据依赖难题。

新智元
算法论文8

仅需152个样本,性能提升48%:Memory-R1如何重塑Agent记忆能力

这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在长对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。

深度学习自然语言处理
7

Meta两员大将回流OpenAI,30天爆赚800万?刚入职闪回巢,小扎钞能力失效

Meta成立两月的“梦之队”MSL痛失三位核心研究员,两位前OpenAI员工入职一月回流,另一位因小扎一句话离职,十年老将也将加入OpenAI。Meta高薪挖人,却因内部重组、研发问题等面临人才流失。

新智元
推荐文章8

人工智能研究者如何意外发现:我们对“学习”的理解,可能全是错的

传统理论认为大模型会过拟合,而如今大模型却驱动了诸多应用。2019年研究者突破传统扩大模型规模,出现‘双下降’现象。‘彩票假说’解释其成功原因,还重新定义了‘智能’,揭示科学进步规律。

宝玉AI
产品应用8

告别复杂提示词!蚂蚁新方式让AI自动理解你的个性化需求

蚂蚁通用人工智能研究中心自然语言处理实验室提出AlignXplore方法,通过强化学习让AI从用户行为归纳偏好并动态更新。该方法训练分两阶段,支持流式偏好推断,实验表现优异,是大模型个性化新尝试。

量子位
开源动态8

碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用能力超强

国内大模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用能力强。测试显示其性能碾压DeepSeek V3等模型,训练流程还有独特技术创新。

AIGC开放社区
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十】| “过拟合” 与 Dropout

文章围绕神经网络过拟合问题展开,介绍了过拟合的概念、危害及产生原因,阐述了缓解过拟合的正则化方法,重点介绍了Dropout随机失活,还指出其局限性及在大模型中的应用策略。

AI大模型应用实践
算法论文8

传统RAG只会翻书不会用?RAG+让Reasoning能力上一个新高度!

现有检索增强生成(RAG)技术在需复杂推理领域表现不佳,像只给菜谱不给实操演示。RAG+开创性新增“应用案例库”,与知识库构成双料库,在数学、法律、医疗场景测试中全面碾压传统方案,团队还透露了未来方向。

深度学习自然语言处理