自注意力机制」共找到 1949 篇相关文章

新闻资讯7

15年差评如潮,Siri终于有救了!苹果10亿真金白银投谷歌一票

苹果宣布和谷歌合作,用Gemini升级Siri等AI功能,此为过渡方案,苹果未来计划推研1万亿参数模型。此前谷歌每年付苹果200亿做搜索,这次苹果或每年付10亿用Gemini。

新智元
产品应用8

全网首测!首款国产GPU「AI算力本」现场上手

新智元报道首款国产GPU「AI算力本」MTT AIBOOK,它搭载国产全功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构全栈研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。

新智元
算法论文7

剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了

剑桥大学等机构研究指出,大模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了条件化等影响及模型规模的作用。

新智元
算法论文8

上海AI Lab提出CANON:让RLVR主识别优质推理模式

上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。

深度学习自然语言处理
新闻资讯8

CVPR史上首次!中国车厂主讲AI大模型,动驾驶也玩Scaling Law?

世界计算机三大顶会之一CVPR 2025落幕,小鹏汽车作为唯一受邀车企,其世界基座模型负责人发表演讲分享成果。小鹏用强化学习打造‘AI大脑’,还研‘世界模型’,从云到端全流程优化,展现中国车企在动驾驶的创新实力。

新智元
新闻资讯8

我嘞个豆!中国企业牵头,ICLR这场Workshop被挤爆了

ICLR 2026在巴西线下举办,华人活跃其中。一场由阿里妈妈牵头的Workshop被围得水泄不通,聚焦机制设计与决策智能,这是ICLR历史上首个该方向Workshop,集结了顶尖高校,探讨AI重写下的相关问题。

量子位
算法论文8

AI看图一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华

随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看图方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。

量子位
开源动态8

没想到,音频大模型开源最彻底的,居然是小红书

近几个月,开源成AI社区焦点,国内厂商七八月开源多款大模型,但音频生成占比小。小红书技术团队去年起在音频领域稳定开源,成果覆盖TTS、ASR方向,具商用属性,降低落地门槛。

机器之心
新闻资讯7

OpenAI 开源模型泄露:六大技术细节

OpenAI 可能发布的开源大模型细节泄露,包含两款模型,1200 亿参数 MoE 模型和 200 亿参数稠密模型,专注文本处理。还涉及训练技术、激活函数、上下文窗口、注意力机制及底层架构等方面的技术细节。

AI寒武纪
开源动态8

正式开源!motion-anything:免费版 Figma Motion + 无水印动效视频工坊来了

Open Design团队开源motion-anything,这是一款开源动效引擎,让动效活在真实网页上,可随时编辑。带庞大动效生态,支持多种触发和动法,有视频工坊且无水印导出,还解决了动效领域四大痛点。

开源星探