「多图像空间推理」共找到 2786 篇相关文章
内存股集体大跌,原因竟是谷歌这篇一年前的论文
美国内存股集体暴跌,诱因是谷歌新博客介绍一年前公布的技术 TurboQuant。它是压缩算法,可大幅减少 LLM KV 缓存内存占用、提升速度且精度零损失,有望打乱市场对内存芯片增长预期。
英伟达GPU全系列硬核科普手册:一文读懂NVIDIA芯片的定位、规格与应用场景
这是英伟达GPU全系列硬核科普手册,覆盖消费级、工作站、推理卡、训练卡及中国特供版五大产品线,讲清区别与用法,还介绍架构演进、命名规则等,助读者秒变选型高手。
生成视频总出物理bug?用VLM迁移+token级对齐,让燃烧在正确位置发生,碰撞遵循动量守恒丨CVPR 2026近满分接收
现有生成式视频模型多停留在“外观拟合”,未真正“物理建模”。中山大学等机构提出ProPhy,构建渐进式物理对齐框架,使模型有“分层物理理解”与“空间物理对齐”能力,论文被CVPR2026近满分接收。
痛点突破:YOLOv26引入AAttn区域注意力机制,精度提升1.3个百分点
文章介绍YOLOv26引入AAttn区域注意力机制,解决传统机制在复杂场景下的不足。它通过划分特征图区域学习权重,提升检测精度,且实现简单。经实验验证,精度提升显著,还给出实现细节与优化建议。
Kimi新架构让马斯克叹服!17岁高中生作者一战成名
17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。
ChatGPT和Claude争了个寂寞!用户重叠仅11%,中国应用霸榜移动端
风投机构a16z发布“迄今最受消费者喜爱的Top100 AI应用”榜单。前50个移动AI应用近半来自中国团队,用户多在海外。ChatGPT领先但挑战者来势汹汹,其与Claude用户重叠仅11%,全球形成三大AI市场。
GPT-5.4发布:OpenAI首个大一统模型,简直是龙虾原生
OpenAI发布GPT - 5.4,这是其首个大一统模型,将推理、编程等能力融合,且单项性能领先。它在知识工作、计算机使用、编程调试等能力提升,定位AI数字员工,虽单价高但有省钱机制。
苹果推出 Ferret-UI Lite:一款用于查看和控制 UI 的端侧 AI 模型
苹果推出 30 亿参数的 Ferret-UI Lite 端侧 AI 模型,可解析屏幕图像、与应用交互。现有 GUI 智能体方法存在建模复杂等问题,Ferret-UI Lite 性能有竞争力,训练采用两阶段流程,还给出应用建议。
菲尔兹奖成果首次被AI完整形式化,Gauss20万行代码改写数学史?
Math, Inc. 公司用 Gauss 智能体完成 8 维和 24 维空间最优球体堆积定理形式化证明,代码约 20 万行。该定理最初由 Maryna Viazovska 及其合作者证明,这是本世纪首个被完全形式化证明的菲尔兹奖成果。
国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测
文章深度实测MiniMax-M2.5编程能力,用其开发多款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。