「训练系统」共找到 3665 篇相关文章
红色警报:OpenAI的Atlas浏览器,是捅向谷歌万亿心脏的匕首吗?
OpenAI推出ChatGPT Atlas浏览器,争夺全球互联网入口,直指谷歌核心业务命脉。谷歌核心收入源于搜索广告,Chrome是确保流量的关键。而Atlas以‘回答’和‘执行’为核心,或让谷歌广告竞价系统失效,谷歌必将强力反击。
ACL 2025 | GALLa:给代码大模型装上“透视眼”,看懂程序的“骨架”!
蚂蚁集团与上海交大合作的 GALLa 研究被 ACL 2025 主会录用。它利用图神经网络将代码图结构信息注入大模型,在 7 个模型和 5 个任务上提升性能,推理与普通 LLM 一致,不增成本。
Mamba-3惊现AI顶会ICLR 2026!CMU知名华人教授一作首代工作AI圈爆红
Transformer有力挑战者Mamba的最新版本Mamba-3进入ICLR 2026盲审。它有三大改进,在长文本处理、实时推理和成本优化有优势。此外,FBAM也从不同角度探索Transformer下一代框架。
《中国Data&AI数据基础设施白皮书》——AI创生核心生产力,开启万亿新基建之路 | 甲子光年智库
全球正处地缘政治与AI技术变革中,AI跃升为核心生产力。中国企业面临‘挤压式转型’,传统数据系统难满足需求。数据厂商需构建新一代数据基础设施,技术上‘湖仓一体’与‘AI原生’融合,推动Data&AI一体化。
数据蒸馏的双重突破:从几何保真到对抗鲁棒
深度学习中,数据集蒸馏可用精简合成样本替代庞大训练集且不牺牲模型性能,但面临精度和可靠性两大难题。两篇发表于 ICCV 2025 和 AAAI 2025 的论文分别给出解决方案,且代码已开源。
OpenAI和DeepMind大佬离职联手,誓用AI科学家实现室温超导!已融3亿美元
OpenAI后训练负责人和DeepMind的AI4S大佬离职成立Periodic Labs,专注用AI Agent改造科研,攻克室温超导等难题,已获3亿美元融资。团队目标是培养AI科学家,构建自主实验室,还将应用于产业。
又一款国产高性能GPU问世,实力对标海外巨头
2025年9月22日,芯动科技发布“风华3号”全功能GPU,它架构全面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。
时隔多年,AI芯片又是华为发布会主角了
华为全联接大会上,轮值董事长徐直军带来全球最强算力超节点和集群。公布昇腾、鲲鹏芯片未来2年演进规划,还开创灵衢互联协议。虽单芯片受限,但集群层面有望实现超越。
谁说Scaling Law到头了?新研究:每一步的微小提升会带来指数级增长
很多人质疑扩大计算规模训练模型的做法,因Scaling Law面临收益递减。但新研究发现,模型单步准确率的微小提升能使完成任务长度指数级增长,还探讨了长程执行能力的衡量及影响因素。
奥特曼:点名表扬两个波兰人,OpenAI还没遇到过他们解决不了的问题
奥特曼点名表扬OpenAI两位波兰科学家Jakub Pachocki和Szymon Sidor,他们贡献从Dota项目扩展强化学习到领导GPT - 4预训练。2023内乱中他们追随奥特曼,后帕哥成首席科学家,西哥为独立贡献者。