统一学习范式」共找到 2518 篇相关文章

算法论文8

TreeHop:无需LLM的高效多跳问答新范式

多跳问答(MHQA)任务有挑战,现有方法依赖LLM,计算成本高、延迟显著。TreeHop研究提出新方案,摒弃LLM,通过嵌入空间动态更新,降低延迟、减少模型参数量,还在主流数据集表现佳,适合工业应用。

深度学习自然语言处理
产品应用8

揭秘超节点,AI算力需要“统一的语言”

AI大模型热潮带动算力行业发展,中国AI芯片崛起,但单颗芯片算力不足、不同设备沟通有障碍成行业难题。华为发布“超节点”架构与“灵衢”技术,搞出“算力普通话”,目标是让算力系统更高效、灵活、省钱。

芯师爷
算法论文8

Meta&CMU:Token级LLM协同路由新范式

Meta AI、CMU等联合推出FusionRoute,是让多个大模型在token级协作的新范式。它能在每个token位置精准选专家,自带“急救包”。经实验验证其高效,也指出了待研究的方向。

PaperAgent
算法论文7

The Batch: 931 | 统一视觉媒体的单一分词器

Apple团队开发多维分词器AToken,可将图像、视频、3D对象映射到共享token空间,统一处理视觉媒体。它由预训练编码器和解码器组成,经多阶段训练,在多任务上达或接近先进水平,为视觉模型带来通用性。

DeeplearningAI
算法论文7

MOE RL实战:统一FP8全流程训练

SGLang RL团队等联合完成工作,实现RL中全流程FP8训练与采样。介绍FP8训练硬件基础、格式、scale选择等,指出训练难点,分析KL Loss异常归因,验证其在MoE模型RL应用效果,还探究模型规模对训推不一致性的影响。

GiantPandaLLM
新闻资讯8

Open Responses 规范实现智能体式 LLM 工作流的统一

OpenAI发布Open Responses开放规范,获Hugging Face等支持,为智能体式AI工作流制定统一标准,减少API碎片化,支持多模态输入等,引发行业对厂商锁定和生态成熟度的讨论。

InfoQ
推荐文章7

强化学习 AI 系统的设计实现及未来发展

本文是阿里巴巴算法专家曹宇在 AICon 2025 北京站的分享,结合算法实践展示 RL 系统现状及发展脉络,探讨未来超大规模 RL 发展方向,涉及理论基础、业界实践、开源生态及社区共建。

AI前线
产品应用8

在 BetterYeah,我看到了一种新的企业生产力范式

2025 WAIC聚焦Agent,C端个人Agent产品热闹,企业级市场落地难。BetterYeah AI获阿里云亿级融资,其解决企业难题,构建“数字同事”,即将发布的Nova Agent开启“AI数字团队”新范式

MacTalk
新闻资讯8

世界经济论坛:AI、机器学习专家,成增长最快职业

世界经济论坛《2025年全球未来就业报告》分析未来五年劳动力市场转型。AI成重塑核心,技术岗位增长,传统岗位衰退。各地区情况有别,报告给出政策与企业应对建议。

AIGC开放社区
产品应用7

英伟达发布统一GPU开发平台DGX Cloud Lepton

英伟达发布专为开发者设计的AI平台DGX Cloud Lepton,可汇聚全球GPU计算资源,提供即时访问和无缝部署能力。它功能强大,支持多环境部署,提供统一体验,还有庞大合作网络。

AIGC开放社区