全注意力机制」共找到 2720 篇相关文章

新闻资讯8

专治Demo玩家:「具身灵巧操作奥林匹克」大赛三项第一,被国内这家公司拿下

星动纪元凭借自研VLA具身智能模型,在具身界灵巧操作奥林匹克Benjie's Olympics大赛中,于翻袜子(银牌难度)、开锁和剥橘子(金牌难度)三项任务上击败技术领先者PI,拿下球第一,展现栈技术优势。

机器之心
开源动态8

Agent 自我改进的六条路

文章梳理了让 AI Agent 不重新训练就能变强的六种机制,包括输出自审、持久记忆、进化搜索、对抗训练、自我修改和编排自优化,介绍了各机制代表项目及成果,指出 AI 学习正从训练溢出到部署阶段。

AGI Hunt
开源动态8

阿里新开源提出建设性安对齐方案,向“让用AI的人安”新范式跃迁

阿里巴巴集团安部联合多高校发布技术报告,提出建设性安对齐理念并集成到Oyster - I模型。该理念突破传统防御式机制,构建新博弈框架,实验显示该模型在安和通用能力上达SOTA水平。

量子位
新闻资讯8

领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%

Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革新大模型扩展路径。

机器之心
新闻资讯8

华人女学霸AI杀疯!本科最难数赛12题对,自主证明首次公开

24岁华人女学霸Carina Hong初创打造的AxiomProver,在2025 Putnam数学竞赛拿下满分,其自主生成的Lean证明也公开。该竞赛是北美本科生数学竞赛天花板,人类满分罕见。此外,GPT - 5.2 Pro数学表现也很强,引发“奇点将近”之感。

新智元
产品应用8

太炸裂了!网实测Nano Banana Pro,网友:这模型里到底装了什么鬼东西!

谷歌Nano Banana Pro出世引发网关注,它又名Gemini 3 Pro Image,整合多模态理解能力与知识库。普通用户可在Gemini应用免费体验,实测显示其实力强悍,还在网友手中玩出花,谷歌CEO也站台。

量子位
新闻资讯7

AI圈两件大事,Meta超级智能实验室大规模裁员,OpenAI新发布的浏览器遭网差评。

近期AI圈热闹非凡。Meta超级智能实验室裁员600人,包括资深人员田渊栋,或因前期扩张致团队臃肿。而OpenAI新发布的浏览器Atlas仅Mac版,口碑差,功能不新鲜,产品成熟度和体验欠佳。

开源AI项目落地
新闻资讯7

是套路!英伟达千亿美元投OpenAI,奥特曼拿钱买卡还让甲骨文赚差价

英伟达计划向OpenAI投资最高1000亿美元,OpenAI要用这笔钱构建至少10GW的AI数据中心,用英伟达系统。首笔100亿预计2026年下半年投入。此外还存在甲骨文参与的“三角财富循环”。

量子位
产品应用7

高考数学卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。

机器之心
新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是模态模型。此外还有多个新模型,构建场景生态。

开源星探