端到端学习」共找到 3467 篇相关文章

算法论文8

Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用全部token训练还好

Qwen与清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超全部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。

量子位
开源动态8

中心动态重分配哈希,北邮团队提出并开源CRH项目 | AAAI 2026

北京邮电大学等机构联合提出新颖框架 CRH,在训练哈希函数时动态更新哈希中心,提升检索精度和语义一致性。论文被 AAAI 2026 收录,代码已开源。

AI前线
新闻资讯8

一年三轮数亿融资!AI新材料研发企业鼎犀智创跑出加速度|甲子光年

AI新材料研发公司鼎犀智创近日完成数亿元Pre - A轮融资,是一年内第三轮。其以「RhinoAI智能研发平台」为核心构建研发闭环,推动材料研发从「经验试错」「智能设计」,还与产业龙头合作,成果显著。

甲子光年
产品应用8

刚刚,智谱推出全球首个手机通用Agent,人人可用

智谱发布新版AutoGLM,是全球首个手机通用Agent。它为用户配备云手机,能在不影响用户操作的前提下完成各类任务,还在技术上有重大突破,成本更低,代表全新互联网流量。

AGI Hunt
算法论文8

超低标注需求,实现医学图像分割!UCSD提出三阶段框架GenSeg

GenSeg用AI生成高质量医学图像及对应分割标注,在仅有几十张样本时也能训练出媲美传统深度模型的分割系统,显著降低医生手工标注负担。它是通用、与模型无关的框架,可集成现有分割模型。

新智元
算法论文8

DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配

现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。

PaperAgent
新闻资讯7

一场机器人黑客松,让具身智能的差距与机会同时显形

作者参加深圳机器人黑客松,这是全球最大规模线下具身智能开发者大赛之一。3天内参赛队伍可完成从数据采集真机部署闭环。比赛让行业差距与机会显形,凸显基模重要性,自变量也给出新方向。

InfoQ
开源动态8

Hugging Face 推出九大 AI 课程,免费、全面【收藏】

Hugging Face悄悄上线一批免费AI课程,还带认证证书。课程从大语言模型扩散模型,从计算机视觉游戏AI,覆盖面广。完成课程可拿证书,还能在平台分享成果,是学习AI的好机会。

AGI Hunt
算法论文8

SceneSplat: 基于3DGS的场景理解和视觉语言预训练,让3D高斯「听懂人话」的一跃

文章引入 SceneSplat,首个在 3DGS 上原生运行的大规模 3D 室内场景理解方法,提出自监督学习方案,构建发布 SceneSplat - 7K 数据集,在多个实验中达 SOTA 效果。

机器之心
算法论文8

真机RL杀疯了!机器人自学20分钟100分,数字孪生封神

至简动力等提出数字孪生协同强化学习框架 TwinRL,可在真机高效执行在线强化学习。它用手机构建数字孪生,让机器人先探索再真机操作,20 分钟达 100%成功率,比现有方法快 30%,还降低人类干预。

新智元