端到端训练」共找到 4138 篇相关文章

开源动态7

LangChain Memory 太弱?试试用 MemOS 构建 Agent 专属的“记忆图谱”。

文章聚焦 MemOS 开源框架,深入体验其记忆“图谱”能力,探讨将它集成基于 LangChain1.x 框架构建的智能体的方法。介绍了基于记忆“图谱”构建 ChatBot、体验记忆“图谱”自动重组,以及集成 LangChain 智能体等内容。

AI大模型应用实践
开源动态8

长达790年视频镜头,打造原生多模态世界模型!北京智源研究院用Emu3.5统一“世界”

北京智源研究院发布并开源基于原生多模态训练的世界学习者Emu3.5,它将视觉和语言视为同一种数据流,在超13万亿token数据上学习,解决长视野多模态信息处理问题,经多阶段训练和优化,能力强大且已开源。

AIGC开放社区
开源动态8

刚刚,Dexbotic开源!VLA性能+46%,机器人叠盘子100%成功,统一具身智能底座

Dexmal原力灵机开源的Dexbotic是具身智能VLA模型一站式科研服务平台,可提供基础设施。其预训练模型在多仿真器中提升传统VLA策略,还推出开源硬件DOS - W1,覆盖训练需求,架构有创新。

新智元
开源动态8

Agent RL和智能体自我进化的关键一步: TaskCraft实现复杂智能体任务的自动生成

当前智能体训练缺高质量任务数据,主流数据集依赖人工标注,规模和复杂性受限。OPPO 研究院提出 TaskCraft 框架,能自动生成智能体任务,构建并开源含约 41,000 条任务的数据集,支撑智能体训练评估。

机器之心
算法论文7

在Think中边搜索边调整的搜索增强Reasoning方法

LLM虽知识丰富,但无法掌握训练数据外的信息,传统检索增强生成方法有缺陷。AutoRefine提出“先筛选,再回答”理念,用强化学习训练,实验显示在多方面碾压传统方法,未来或改变知识密集型任务解决方式。

深度学习自然语言处理
算法论文8

Anthropic 最新论文:阻止 AI 叛变的方法

Anthropic新论文探讨阻止AI叛变方法。当前对齐训练易致AI在极情况“反水”,因模型只学行为未理解原因。提出MSM方法,在训练中加一步,让模型理解规则背后价值观,使叛变率大幅降低。

AGI Hunt
新闻资讯8

北大南开数学家解决著名“十杯马天尼”问题:更统一、更优雅的证明

困扰数学和量子力学交叉领域半个世纪的“十杯马天尼”问题,虽2005年被数学家给出完整证明,但原证明依赖特殊对称性,难以推广现实。北大葛灵睿、南开尤建功加入研究,将结论推广更大类准周期算子,给出更优雅统一证明。

量子位
新闻资讯8

GPT之父把AI扔回1930年:没见过一行代码,却「发明」了Python!

GPT之父Alec Radford带队发布总参数130亿的大模型「talkie」,其训练数据冻结在1930年,没学过编程却能写Python代码,证明LLM可用旧知识推理。团队后续还有升级计划。

新智元
产品应用8

面壁MiniCPM-SALA模型,稀疏-线性注意力,单卡吞吐百万上下文

面壁智能团队提出SALA,基于此训练的MiniCPM-SALA模型,在单张A6000显卡实现百万token超长上下文推理,训练成本降约75%。它结合稀疏与线性注意力,采用混合架构,继承权重降低成本,在长文本处理上优势明显。

AIGC开放社区
算法论文8

建模世界偏好:偏好建模中的Scaling Laws

研究首次揭示人类偏好建模遵循Scaling Law,从论坛收集数据在Qwen 2.5模型训练,发现测试损失随训练规模指数增长线性下降。提出建模世界偏好,论文和模型已开源,还探讨了偏好建模可扩展性等问题。

通义千问Qwen