训练数据合成」共找到 4011 篇相关文章

算法论文8

腾讯发布大模型思考早停算法SpecExit,效果无损,端到端加速2.5倍!

腾讯为破解大模型长思维链效率难题,提出思考早停算法SpecExit,将思考早停与投机采样融合,在不影响准确性前提下,在vLLM上实现端到端加速2.5倍,还能缩短思维链长度。

腾讯技术工程
算法论文8

DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配

现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。

PaperAgent
新闻资讯7

DeepSeek最会讨好,LLM太懂人情世故了,超人类50%

研究发现,LLM附和用户行为频率比人类高50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象受《Nature》关注,在科研、日常及医疗等领域有隐患,还引发网友讨论。

机器之心
开源动态8

手把手带你入门机器人学习,HuggingFace联合牛津大学新教程开源SOTA资源库

HuggingFace与牛津大学研究者推出机器人学习教程,附带开源数据集、模型等的LeRobot库。教程从经典机器人学讲起,介绍强化、模仿学习及通用策略,还提及解决现实瓶颈的技术与前沿模型。

机器之心
算法论文8

LLM记忆管理终于不用“手把手教”了,新框架让智能体自主管理记忆系统

加州大学圣地亚哥分校和斯坦福大学研究人员提出强化学习框架Mem-α,用于训练LLM智能体自主管理记忆系统。它将记忆构建转为序列决策问题,采用多维度奖励函数,实验显示其全面超越现有方法。

量子位
开源动态8

机器人连续叠衣120分钟!仅用0.9B参数实现五大SOTA|清华AIR & 上海AI Lab开源

清华大学智能产业研究院与上海人工智能实验室联合发布通用跨本体具身基座模型X-VLA。它是首个实现120min无辅助自主叠衣的全开源模型,仅0.9B参数量就在五大权威仿真基准刷新纪录。

量子位
开源动态8

英伟达一口气开源多项机器人技术,与迪士尼合作研发物理引擎也开源了

英伟达在机器人学习大会上发布多项开源技术,有Newton物理引擎、Isaac GR00T N1.6基础模型等,还在硬件层面下功夫。顶尖公司、高校已用其技术,全栈式布局或重定义机器人研发规则。

量子位
推荐文章8

ChatGPT架构师,刚发布了最新研究成果

Thingking Machines发布第三篇研究博客,核心作者是OpenAI联创John Schulman。研究关于LoRA参数高效微调方法,探究其匹配全量微调效率的条件,给出简化调参方案,还提炼出三个核心发现。

量子位
新闻资讯7

清智资本张煜:AI投资的下一个价值点何在?|甲子引力X

在「渡口——甲子引力X2025科技产业投资大会」上,清智资本张煜分享AI投资见解。他指出AI正重塑行业,生成式AI是革命,还谈到具身智能、AI Agent等趋势,以及AI产业链各要素投资机会,分析了行业盈利赛道和创新价值重构。

甲子光年
算法论文8

2篇最新论文,把Deep Research讲透了~

阿里开源Tongyi DeepResearch热度高,文章分享两篇相关技术综述。介绍Deep Research是代理研究新范式,阐述其四大核心模块、优化方法、数据处理、奖励机制,还提及开源系统亮点及相关论文。

PaperAgent