演进式架构」共找到 2566 篇相关文章

算法论文8

华为发布业界首个扩散语言模型Agent,部分场景提速8倍!

华为等团队研究发现,把Agent“底座”换成扩散大模型(DLLM),执行速度提升30%以上,部分复杂任务效率达传统AR模型8倍。其优势源于生成范,可重塑Agent设计。

量子位
产品应用8

Claude一夜吞掉所有APP,全球打工人变天!AI时代「操作系统」诞生

Anthropic官宣十大办公神器可在Claude中交互,集成「MCP Apps」打破AI与软件工具隔阂。Claude从单一对话助手向「AI工作站」演进,新功能已向部分用户开放,MCP Apps带来交互革命。

新智元
开源动态8

微软重磅开源!22K星的 VibeVoice 再添新成员,60分钟音频 ASR 端到端统一输出!

现在的 ASR 模型处理长音频存在断章取义、说话人错乱等问题。微软开源 VibeVoice-ASR,可一次性处理 60 分钟音频,实现“三位一体”输出,补齐 VibeVoice 生态,还介绍了特点、架构、使用方法与应用场景。

开源星探
开源动态7

一夜爆火,Clawdbot是否才是真正的AI入口产品?

文章介绍近期在GitHub爆火的开源项目Clawdbot,它是运行在本地设备、有“手脚”和“记忆”的AI智能体。还分享部署方案,从产品层面分析其特点,最后提醒安全风险。

腾讯技术工程
算法论文8

Nature | 清华&芝大团队:AI让个体科学家“加速”,却让科学边界“收缩”

2026年1月14日,清华与芝大团队在《Nature》发表研究,通过分析4100余万篇论文,揭示AI融入科研的“双重效应”:它是个人科研“加速器”,让使用者产出和职业发展提升;也是科学整体“收缩器”,使集体知识疆域收窄。

力学与人工智能
产品应用7

瑞幸背后的芯片,藏不住了

瑞幸咖啡背后的边缘侧AI需算力就近部署,芯片是关键,其采用了天数智芯的彤央系列边端算力产品。该系列发布四款新品,覆盖不同部署需求,还在多行业落地,天数智芯更有云端超越英伟达的野心。

量子位
开源动态8

把RoPE扔掉,AI更能看懂长上下文!Transformer作者团队开源大模型预训练新方法

Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。

量子位
推荐文章8

今年最具启发的Claude Code用例:她用cc搭了8个Agent监控自己的生活

文章介绍Molly Cantillon用Claude Code搭建8个并行Agent实例监控生活,涵盖产品运营到睡眠管理等。她21岁辍学创业,其架构新颖,还提出权力关系逆转观点,最后给出使用建议与警告。

花叔
算法论文8

注意力机制大变革?Bengio团队找到了一种超越Transformer的硬件对齐方案

Transformer虽改变世界但不完美,线性递归等新方法理论有优势,实际在GPU表现不佳。Bengio团队提出硬件对齐算法框架,用滑动窗口循环和B2P算法,实验显示有速度与质量双重突破。

机器之心
开源动态8

自回归因果注意力也能并行解码?上交联合UCSD突破LLM推理瓶颈,模型代码全开源

大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。

机器之心