自回归架构」共找到 2864 篇相关文章

新闻资讯7

用得越多、失业越快?GitHub 大改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!

当地时间3月26日,GitHub宣布4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练AI模型,Business和Enterprise用户除外。GitHub称需更多数据覆盖编码场景,但此举遭用户吐槽。

AI前线
算法论文8

OpenClaw带火AI记忆,DeepMind用混合记忆把3D重建拉到近2万帧

近期,全球爆火的 Agent 私人助手 OpenClaw 接连更新,其长期记忆能力获关注。谷歌 DeepMind 联合加州大学伯克利分校提出 LoGeR 架构,将 3D 重建扩展到极长序列,在多数据集上表现超越先前方法。

机器之心
新闻资讯8

截击英伟达!OpenClaw狂吞Token,北大系芯片黑马剑指2000 Tokens/s

NVIDIA GTC 2026前夕,AI推理赛道竞争激烈。北大系寒序科技宣布融资,首颗样片测试跑通,单位面积带宽达100GB/s/mm²,下一代「MRAM+SRAM」架构目标2000 Tokens/s,挑战英伟达。

新智元
开源动态8

下载量超 1300 万,昇思 MindSpore:AI 框架迈入“超节点时代”

开源五周年,昇思 MindSpore 成绩亮眼,下载量超 1300 万。它完善大模型、部署、科学计算等核心能力,还提出 HyperParallel 架构应对新挑战,正式版及套件明年上半年发布,未来社区将多方向推进。

AI前线
算法论文8

时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8

在大语言模型发展中,Transformer注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。

机器之心
产品应用7

超 10 万人都在看!Qwen3重塑文本嵌入与重排序技术版图

文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。

CourseAI
开源动态7

还是你们会玩,2.9k Star OpenBiliClaw

OpenBiliClaw把浏览器扩展等拼成内容发现Agent,将内容推荐主导权交回用户。它汇总显式授权来源信号找内容,形成本地画像。介绍其架构层级、核心闭环,也提醒“本地优先”仍需做隐私检查。

小华同学ai
新闻资讯7

独家|华为系帧跃科技完成千万美金天使轮融资,将发布视频产品 Leadde

AI 科技评论独家获悉,主攻 AI 交互式视频赛道的帧跃科技完成千万美金级天使轮融资。创始人杨昌鹏和联合创始人李明磊均有华为任职经历。公司提出‘三位一体’架构,2026 年下半年将发布产品 Leadde。

AI科技评论
开源动态8

这款 Rust 文件搜索项目,让 AI 和 neovim 飞起来!

开发时项目大文件多,找文件成本高。Github上的`fff.nvim`项目专注‘极致速度 + 智能体验’,采用Lua + Rust架构,性能好、排序智能。有多项功能特性,还能与AI助手集成,提升效率。

开源先锋
新闻资讯8

黄仁勋:龙虾就是新操作系统!英伟达7种芯片拼出算力怪兽,放话2027营收万亿美元

英伟达GTC 2026上,黄仁勋回顾发展历程后预计2027年营收至少达1万亿美元。介绍Token工厂经济学,推出Vera Rubin系统,还谈及OpenClaw,断言企业IT逻辑将改写,也预告了Feynman架构和太空数据中心。

量子位