高质量论文」共找到 3095 篇相关文章

算法论文8

全新GPU速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代带宽域架构

随着大模型参数规模扩大,分布式训练成关键路径,带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位
新闻资讯7

开发者把掌舵人骂到关回复!Windows 要变成“Agent OS”?这位印度裔管遭遇大型翻车现场

微软管 Pavan Davuluri 宣传 Windows 将演变为 Agentic OS,推文评论区却被批评淹没,他无奈关评论。微软正推动 Windows 向 AI 驱动转型,可开发者和用户更想要稳定系统,对 AI 改造不满。

InfoQ
开源动态8

首个基于MCP 的 RAG 框架:UltraRAG 2.0用几十行代码实现性能RAG, 拒绝冗长工程实现

检索增强生成系统(RAG)复杂度提升,工程实现成本。清华大学等联合推出首个基于MCP架构的UltraRAG 2.0,组件化封装、调用扩展灵活,低代码实现性能,可用于科研和行业应用。

AI前线
新闻资讯8

ACL最佳论文幕后的北大人!北大张铭带出顶会常胜军和百亿CEO天团|新智元十周年峰会

北大张铭教授团队十年两度获世界顶会「最佳论文」,学生有人写大奖论文,有人创办百亿企业,中生也能参与科研拿奖。其将科研思维与创新教育结合,走出独特人才培养路径。

新智元
算法论文7

谁不想要一条会飞的鱼呢?他们造了个会捣蛋的机器人,拿下了最佳论文

庆应义塾大学徐铭阳和香港城市大学李彦衡发表论文Floating Companion,获ACM DIS 2026最佳论文奖。他们研究软体浮空机器人,探讨其与人的关系、交互可能,虽面临浮力 - 质量循环等挑战,但对其未来充满期待。

DeepTech深科技
开源动态8

【GitHub 10.9k star】DeepCode:把论文和需求文档“一键变代码”的多智能体开发神器,真能干掉手写样板?

DeepCode 是香港大学开源的多智能体开发平台,支持将论文、需求文档等转化为生产级代码。它能解决论文复现、原型开发等痛点,有多项特色功能,在性能对比中领先,适用于多类场景。

小华同学ai
算法论文8

天下武功,唯快不破:LLM效架构最新最全面综述

大型语言模型虽成就辉煌,但训练成本、推理延迟大,核心问题源于Transformer架构。这篇综述论文首次系统性梳理效LLM架构创新方案,分类七大类方法,延伸至跨模态应用,为研究者提供‘效率蓝图’。

深度学习自然语言处理
8

刚刚,小云雀的短剧Agent上线了,背后是字节自己的Seedance 2.0。

字节的小云雀短剧Agent上线,以Seedance 2.0为底层模型。它能根据剧本或设定自动生成质量短剧,提升了AI短剧创作效率,且不挑风格。文中还介绍了使用流程及剧本创作方法。

数字生命卡兹克
算法论文8

DeepMind:Transformer存在拓扑缺陷,思维链治标不治本

谷歌DeepMind论文指出,Transformer架构不擅长追踪状态,思维链只是给结构性缺陷打补丁,成本论文主张用循环架构替代或补充纯前馈结构,还提出多个研究方向,认为下一代模型需构建‘流动的现实表示’。

机器之心
算法论文8

腾讯网关TGW:用户无感知快速迁移及故障自愈能力 | USENIX ATC '25

腾讯与清华联合论文入选USENIX ATC '25,阐述稳定运行多年的TGW网关架构,展示无损迁移、故障自愈及定位系统。该架构应对业务流量挑战,有性能、可用等特性,还分享运营经验。

腾讯技术工程