联合自注意力」共找到 2250 篇相关文章

新闻资讯7

GPT-5编程成绩有猫腻!删23道测试题,关键基准还是己提的

有人发现OpenAI测试GPT-5编程能力时,用的SWE-bench Verified子集仅477题,行省略23题。若这些题默认零分,其得分比Claude Opus 4.1低。且该基准还是OpenAI己提出的。

量子位
新闻资讯7

OpenAI 不想再「跪着」买显卡了

《金融时报》消息,OpenAI 正和博通合作研代号“XPU”的 AI 推理芯片,2026 年量产。其不仅在芯片发力,还在硬件、应用和算力基建多线出击,不过研芯片也面临资金、人才和软件生态等问题。

AI科技评论
新闻资讯8

Anthropic冲塔ASI进化,要做全球操作系统!Claude OS一刀砍向6.4万亿帝国

Anthropic野心勃勃,开启ASI进化,目标打造全宇宙最强AI操作系统Claude OS,欲抢夺苹果微软6.4万亿市值。Claude可控制电脑,多项功能上新,还推出动模式,且营收增长快、客户结构优化,离ASI越来越近。

新智元
算法论文8

图像分词器造反了!华为 Selftok:回归内核完美统一扩散模型,触发像素主推理

华为盘古多模态生成团队推出 Selftok 技术,通过反向扩散将回归先验融入视觉 token。它突破传统,实现因果 token、强化学习友好型 token 及纯 AR 大一统架构,实验在多方面表现优异,论文还入选 CVPR 2025 最佳候选。

机器之心
算法论文8

AAAI 2026 Oral | 悉尼科技大学联合港理工打破「一刀切」,联邦推荐如何实现「千人千面」的图文融合?

悉尼科技大学龙国栋团队联合港理工杨强、张成奇团队提出 FedVLR 框架,解决联邦环境多模态融合异质性难题,被 AAAI 2026 接收。该框架创新性强,可提升推荐指标,代码已开源。

机器之心
算法论文8

NeurIPS 2025 | 北大联合小红书提出Uni-Instruct:ImageNet单步生图FID进入1.0时代!

北大联合小红书提出的 Uni - Instruct 框架被 NeurIPS 2025 接收,它统一超 10 种单步扩散模型蒸馏方法,在多项任务达最佳性能,还能用于文本到 3D 生成。

机器之心
算法论文7

从deepseek v4的受限流线型超链接mHC谈架构优化

文章围绕DeepSeek v4的受限流线型超链接mHC探讨架构优化。指出过去十年深度学习重扩展层内计算,忽视层间通信。介绍多种层间通信改进方法,提出用检索替代累加,还提及深度注意力机制及混合深度注意力的成果。

Agent的潜意识
新闻资讯8

WAIC机器人探展:我被全场最靓的崽「Moz1」种草了

2025 年世界人工智能大会上,千寻智能的人形机器人 Moz1 大放异彩。它搭载研 VLA 模型 Spirit v1,具备强大泛化能力,硬件也有多项突破。千寻智能全栈研技术,资本持续加码,有望推动具身智能商业应用。

机器之心
产品应用8

华为升级行业Agent算法架构!MindScale己写prompt和工作流,KV Cache减少5.7倍token

华为诺亚方舟实验室更新面向行业应用的算法包MindScale,融合算法创新与业务实践经验。它梳理了Agent时代技术挑战,给出技术论文与昇腾代码,应对工作流维护等难题,还提升训推效率、适配国产硬件。

量子位
算法论文8

LLM内部竟藏着众多策略模型?所&腾讯团队首次揭示大模型RL新机制

中国科学院动化研究所与腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。

深度学习自然语言处理