反思与纠错」共找到 6612 篇相关文章

算法论文7

微软等提出「模型链」新范式,Transformer性能相当,扩展性灵活性更好

随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软等研究者提出 CoR 概念,构建模型链学习范式,应用于语言模型得 CoLM 系列,实验显示其性能相当且扩展性、灵活性更好。

机器之心
新闻资讯7

Claude惨遭停用, GPT-4.1接任! 绝密备忘录爆出, 怒撕「硅谷甄嬛」奥特曼

一份绝密备忘录爆出,Dario Amodei 怒喷 OpenAI 五角大楼的交易是「安全作秀」。美国国务院等抛弃 Claude,接入 GPT - 4.1,多家国防科技公司停用 Claude,Anthropic 大厂合作或被切割。

新智元
推荐文章7

如何为 GPU 提供充足存储:AI 训练中的存储性能扩展性

文章分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在 AI 训练中表现。在满足 GPU 利用率阈值下,能支撑更多 GPU 的存储系统扩展性稳定性更强,还需关注资源利用率。以太网存储方案灵活且成本效益高。

AI前线
新闻资讯7

一场机器人黑客松,让具身智能的差距机会同时显形

作者参加深圳机器人黑客松,这是全球最大规模线下具身智能开发者大赛之一。3天内参赛队伍可完成从数据采集到真机部署闭环。比赛让行业差距机会显形,凸显基模重要性,自变量也给出新方向。

InfoQ
算法论文8

零样本&少样本横扫12个工业医疗数据集:西门子×腾讯优图新研究精准定位缺陷,检测精度新SOTA丨AAAI 2026

西门子腾讯优图联合团队提出AdaptCLIP通用视觉异常检测框架,不改动CLIP主干,引入轻量适配器。它兼容零样本/少样本推理,在12个数据集评估表现优,兼顾精度部署需求。

量子位
推荐文章7

TileLang深入详解-第一章-GPU 体系结构复习

作者借长假学习 TileLang 并撰写此文,先复习 GPU 体系结构,包括计算线程组织、存储层次、专用指令单元,接着介绍核心性能模型优化原理,最后给出基于 TileLang 的基准测试实践。

GiantPandaLLM
产品应用8

国产物理AI黑马杀出!超越GPT斯坦福Biomni,狂揽生物制造SOTA

恩和科技发布全球首个面向生物制造的物理人工智能平台 SAION AI,打破大模型只能虚拟辅助的刻板印象。它有认知、控制闭环执行三层架构,在多项测试中表现领先,具备多方面核心优势,推动生物制造进入智能工程时代。

新智元
新闻资讯7

中美AI竞争的四种未来:OpenAI情报调查团队指出决胜点

OpenAI情报调查团队对中美未来几年AI竞争进行推演,指出美国有资本、算力等优势,但面临电力等问题;中国靠国家意志推动,有工业协调等优势。未来博弈有四种结局,决胜看中国算力自救、全球‘朋友圈’和本土市场消化能力。

AIGC开放社区
推荐文章8

Python语言从2.7到3.14的能力变化演进逻辑

文章从编程风格、类库生态、性能优化等多维度,阐述Python从2.7到3.14版本的能力变化演进逻辑。如编程风格现现代化转型,类库生态战略性调整,性能优化有突破性进展等,还分析了演进背后的推动力及未来趋势。

阿里云开发者
算法论文8

SIGGRAPH 2026 | 无需训练,一段单目视频解锁任意运镜「子弹时间」

来自UIUC、宾大Netflix Eyeline Labs的研究团队提出FreeOrbit4D,无需训练模型,用单目视频就能实现任意运镜和“子弹时间”。它通过“前景补全的4D重建”提供几何支架,在大角度视角变化下表现出色,还带来诸多应用。

机器之心