噪声空间」共找到 529 篇相关文章

新闻资讯7

Grok 4刷新ARC-AGI-2纪录:15.9%碾压所有公开模型,我们离AGI还有多远?

xAI的Grok 4在ARC-AGI-2测试中获15.9%,成全球最强公开AI模型。ARC Prize主席还原测试过程,虽成绩亮眼,但网友有质疑,且离人类表现差距大。Grok 4在多基准测试领先,定价便宜。

AGI Hunt
新闻资讯8

12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看

谷歌将图像生成常用的“扩散技术”引入语言模型,推出Gemini Diffusion,12秒能生成1万tokens,速度比Gemini 2.0 Flash - Lite更快。它通过逐步优化噪声学习生成输出,目前是实验性演示,可申请体验。

量子位
新闻资讯8

神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光

神秘具身团队放出一连串Demo视频,其内部代号“MVP”的模型让机器人似人般思考决策。视频展示机器人在不同场景下的表现,如躲避推搡、做家务、机器人协作、高效收纳等,体现对物理规则和人类习惯的理解与自进化能力。

量子位
开源动态7

具身智能的「ChatGPT时刻」还没到,科沃斯先把机器人拆开了

科沃斯将旗下具身智能机器人“八界”开源,成立“八界开源智创空间”,开放从硬件到底层系统的使用权限。该机器人由轮式底盘加机械臂构成,科沃斯董事长钱东奇不看好人形及VLA技术路线。

量子位
开源动态8

DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~

上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。

PaperAgent
产品应用8

小米AI语音新框架:人人都能当声音导演

小米大模型应用团队提出Midasheng - audio - generate与Xiaomi Any2Speech两大音频生成框架。前者可实现全场景声音重建,后者让AI学会理解声学空间与叙事逻辑,改变了语音合成应用场景与思路。

量子位
算法论文7

世界模型开始做减法?LeCun团队和清华团队给出两种思路

近期,Yann LeCun团队的LeWorldModel用简洁JEPA实现从像素端到端训练世界模型,降复杂度且验证潜在空间物理刻画能力;清华团队的Fast - WAM探讨推理阶段显式生成未来必要性,给出高效替代路径。

机器之心
算法论文8

生成视频总出物理bug?用VLM迁移+token级对齐,让燃烧在正确位置发生,碰撞遵循动量守恒丨CVPR 2026近满分接收

现有生成式视频模型多停留在“外观拟合”,未真正“物理建模”。中山大学等机构提出ProPhy,构建渐进式物理对齐框架,使模型有“分层物理理解”与“空间物理对齐”能力,论文被CVPR2026近满分接收。

量子位
算法论文8

痛点突破:YOLOv26引入AAttn区域注意力机制,精度提升1.3个百分点

文章介绍YOLOv26引入AAttn区域注意力机制,解决传统机制在复杂场景下的不足。它通过划分特征图区域学习权重,提升检测精度,且实现简单。经实验验证,精度提升显著,还给出实现细节与优化建议。

机器学习AI算法工程
新闻资讯8

菲尔兹奖成果首次被AI完整形式化,Gauss20万行代码改写数学史?

Math, Inc. 公司用 Gauss 智能体完成 8 维和 24 维空间最优球体堆积定理形式化证明,代码约 20 万行。该定理最初由 Maryna Viazovska 及其合作者证明,这是本世纪首个被完全形式化证明的菲尔兹奖成果。

机器之心