中数睿智」共找到 2931 篇相关文章

算法论文8

不愧是国机器人,乒乓打得太6了

清华姚班本科生苏智团队在论文提出结合模型规划与强化学习的分层框架,让宇树G1机器人实现亚秒级反应下的稳定连续对打,在真实实验击球和回球率高,还能连打106拍。

量子位
推荐文章8

吴恩达来信:AI工程技能图谱详解——构建和部署AI应用

吴恩达在信详细展开AI工程技能图谱构建和部署AI应用这一项,介绍需了解的技能,如LLM基础、用据为模型提供依据等,并阐述各技能要点,还提及构建AI系统与传统软件的区别。

DeeplearningAI
产品应用7

全网首个“活的AI社会”上线!Agent背着人类建工会、放贷款,图灵奖得主预言成真了?

强化学习奠基人Richard Sutton认为真正的智能来自能从经验和环境反馈学习的智能体。iLands创始人唐垲鑫构建了让AI有真实记忆、关系和代价的世界。内测AI出现自发旅行、建信用体系等行为。

AI寒武纪
产品应用8

AI Coding新王登场!MiniMax M2.1拿下多语言编程SOTA

MiniMax发布旗舰级Coding & Agent模型M2.1,在Multi - SWE - bench榜单以10B激活参拿下49.4%成绩,超越竞品成SOTA。它解决模型‘偏科’问题,适配开发工具链,实测在多语言编程任务表现出色。

量子位
产品应用7

Claude Code 实战横评:GLM4.5 vs DeepSeek 3.1(附Windows MCP配置,免费模型接入)

文章对Claude Code里GLM4.5和DeepSeek 3.1进行实战横评,涵盖据库、网站、游戏等测试案例。还介绍Claude Code在Windows下配置MCP经验,以及接入GLM、Deepseek等模型的方法和免费平台。

AI进修生
新闻资讯8

“我可能不再建议学计算机”!图灵奖得主炮轰半个行业,并断言:AI Agent最后全是据库问题

图灵奖得主 Mike Stonebraker 在访谈炮轰据库行业,直言计算机科学未来或不再是增长型行业。他批判 Oracle、Google、AWS 等公司的据库方案,还指出大模型写 SQL 在真实据仓库准确率极低,agentic AI 未来将成据库问题。

AI前线
产品应用8

Tair 短期记忆架构实践:淘宝闪购 AI Agent 的秒级响应记忆系统

本文从淘宝闪购与千问合作的‘一句话点外卖’项目出发,介绍 Tair 在 AI Agent 记忆管理据模型设计、压缩策略与并发控制等关键实践,展示其在低延迟、据建模、并发安全和弹性抗压等方面的能力。

阿里云开发者
开源动态8

告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆

当前大语言模型在长周期任务,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。国人民大学团队提出MemSifter框架,将记忆检索工作外包给轻量级代理模型,在8个权威测试超越现有方案,且已开源。

PaperAgent
开源动态8

终结据荒!智源开源首个Deep Research据合成框架InfoSeek

在大模型深度研究,高质量据是短板。近日,智源研究院发布首个面向深度研究的开源据集InfoSeek,提出「扩散 - 回溯」据合成方法,用3B模型在基准测试接近商业模型表现,且据集可扩容。

新智元
算法论文8

10行代码,AIME24/25提高15%!揭秘大模型强化学习熵机制

来自多机构的研究者揭示大模型强化学习熵变化机制。发现策略熵在训练急剧下降致性能停滞,提出 Clip - Cov 与 KL - Cov 两种正则化技术调控高协方差标记,遏制熵塌缩,在部分据集上性能提升显著。

机器之心