推理训练数据」共找到 5210 篇相关文章

推荐文章8

深度解析大模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景

大模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。

腾讯技术工程
新闻资讯8

干货超标!腾讯混元3D负责人郭春超:真正的3D AIGC革命,还没开始!

腾讯混元团队推出开源项目 Hunyuan 3D 成焦点。腾讯混元 3D 负责人郭春超在 2025 全球机器学习技术大会上表示,真正的 3D AIGC 革命还未开始,分享了 3D 生成现状、挑战及未来等核心洞察。

AI科技大本营
产品应用8

通义灵码编程智能体,上线!

近期 Qwen3 正式发布并开源 8 款「混合推理模型」,表现出色。通义灵码全面支持 Qwen3 并上线编程智能体,具备多种能力,支持配置 MCP 工具,集成魔搭 MCP 广场,能大幅提升开发效率。

阿里云开发者
推荐文章8

来吧,往死理卷,9.8K Star TypeWords~~~

本文推荐Star量9.8K的开源背词项目TypeWords,针对「眼熟单词写不出」的痛点,设计了无提示输出的练习闭环,面向技术人给出使用指南,同时说明其本地存储特性与同步限制。

小华同学ai
产品应用9

OpenAI押注RSI,国产AI火速交卷!Flash叫板万亿大模型

OpenAI、Anthropic先后公开布局递归自我改进(RSI),国内云知声推出搭载RSI自迭代机制的U2-Flash大模型,本文带来实测表现与技术路径拆解,验证小激活规模对标万亿大模型的可行性。

新智元
开源动态9

SGLang 的 DeepSeek-V4.1 Flash Day 0 优化实录:4×B300 上 BS=1 达到 764 tokens/s

本文是SGLang团队的DeepSeek-V4.1 Flash Day 0优化实录,详解了架构适配、KV cache压缩、kernel优化到DSpark适配全流程,公开4×B300 GPU实测吞吐数据,附复现代码与步骤

GiantPandaLLM
新闻资讯9

每周免费送1亿Token!扎克伯格押注王牌产品Muse:AI会24小时替你赚钱,我只负责抽成

本文整理科技记者对扎克伯格的播客访谈,扎克伯格公开反对AI技术被少数机构垄断,介绍了Meta全新推出的个人AI产品Muse的产品设计、商业模式与研发思路。

AI科技大本营
算法论文7

Meta全开源HumanCLAW:基础模型正进入具身智能的决策层

过去基础模型主要理解和描述物理世界,如今开始进入机器人控制栈。Meta等提出HumanCLAW,将高层行动与低层运动控制分开。评测显示当前模型在行动决策上存在不足,未来可从多方向推进研究。

机器之心
新闻资讯8

首批GPT-6内测结果好离谱啊。。。

GPT - 6使用资格分批开放,内测玩家抢先体验。其在3D生成、游戏开发、网页制作等多领域表现出色,如15分钟做出Mac应用,空间推理达世界级水平,但运行时Token消耗大。

量子位
算法论文8

T-RO综述重构Foundation Model时代机器人操作知识版图

近日,论文《Embodied Robot Manipulation in the Era of Foundation Models: Planning and Learning Perspectives》被IEEE Transactions on Robotics接收,它以High - Level Planning和Low - Level Action Modeling为主线,梳理Foundation Model时代机器人操作发展,分析了现存问题及关键缺口。

机器之心