多粒度理解」共找到 4689 篇相关文章

新闻资讯8

演讲 | 强化学习之父 Sutton 隔空回应 Hinton:目前的 AI “理解不足,调参有余”

强化学习之父 Rich Sutton 在 UCLA 演讲《AI 的未来》,指出当下 AI“理解不足,调参有余”,是“脆弱的心智”。他定义智能,倡导建立统一心智科学,认为应从“人类数据时代”进入“经验时代”,还谈及 AI 政治与哲学。

AI科技大本营
产品应用8

全球第二、国内第一!钉钉发布DeepResearch智能体框架,已在真实企业部署

在数字经济浪潮中,企业对高效信息获取与决策支持需求迫切,但现有研究系统存在不足。阿里巴巴钉钉团队提出Dingtalk - DeepResearch智能体框架,在评测中成绩优异,已在真实企业场景部署。

机器之心
开源动态8

GitHub一周2000星!国产统一图像生成模型神器升级,理解质量双up,还学会了“反思”

智源研究院发布国产开源统一图像生成模型OmniGen 2.0版本。它增强理解与生成能力,打通模态生态。玩法简单,技术有创新,还引入反思机制和新基准,推理效率提升,且将全面开源。

量子位
产品应用8

打开高德的理由又一条!全球首个「需求链智能调度」AI地图上线

8月,全球首个AI原生地图应用——高德地图2025上线。它有「需求链智能调度」系统,能处理任务出行。其ST - MAC技术可解构复杂请求、构建群体智能服务生态,还有时空感知、AI探索等功能。

新智元
开源动态8

社区供稿丨Jina-VLM:可在笔记本上跑的语言视觉小模型

Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,项测试表现优,还介绍架构、训练策略和上手方式。

Hugging Face
算法论文8

AI 如何讲好一个人故事?首个支持角色互动的3D场景叙事系统

首尔国立大学提出全新框架,能生成虚拟动态场景并支持角色上下文动作生成。引入LLM拆解复杂任务,系统用事件驱动方式规划动作,还构建基准评估相关能力,有良好扩展性和实用性。

带你学AI
产品应用7

国产游戏理解模型刷新SOTA,对话逗逗AI CEO:开源模型+行业数据是突破关键

2025年末国产开源模型影响力凸显,东京电玩展上逗逗AI的游戏理解模型LynkSoul VLM v1超顶尖闭源模型。其CEO刘斌新表示,开源模型结合行业数据是突破关键,还探讨了产品技术、交互及发展趋势等。

量子位
推荐文章8

Agent 一年半开发复盘:大家对 Agent 的理解有错位,有效的「认知流程」很关键

本文是作者对一年半AI开发过程的复盘,指出大家对Agent理解有错位,强调有效「认知流程」的关键作用。通过高考、学霸成长等例子阐述Agent核心,对比Chatbot与Agent,还从理论视角解释其有效性,最后点明开发者角色转变及面临的挑战与前沿探索方向。

Founder Park
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向智能体系统的失败归因

随着大语言模型发展,智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

深度学习自然语言处理
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向智能体系统的失败归因

随着大语言模型发展,智能体系统潜力大但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

PaperAgent