大厂自研」共找到 5829 篇相关文章

开源动态8

Day0迁移、一键部署,华为开源的昇思MindSpore成为模型开发的“万能钥匙”

模型无法一统天下的背景下,开发者面临在一个框架、生态体验众多主流模型和AI技术的难题。华为开源的昇思MindSpore可实现训练Day0迁移、推理一键部署,还介绍了其相关技术和实测效果。

量子位
产品应用8

腾讯混元AI Infra如何优化Hy3 Preview:一次模型推理性能提升的技术拆解

文章聚焦腾讯混元AI Infra对Hy3 preview模型的推理性能优化。从算子优化与融合、并行策略等五维度,剖析技术思路、算法及收益,如Attention算子单batch长文本最高加速2.95x,还提及后续显存优化等工作。

腾讯技术工程
算法论文8

网络顶会获奖!华为提出端网协同RDMA传输架构,解决规模AI集群网络可扩展性问题

全球网络通信顶会 ACM SIGCOMM 2025 落幕,华为与港科合作的 DCP 研究成果获奖。该论文提出数控分离传输架构 DCP,解决规模 AI 集群网络可扩展性难题,实验显示其性能优于现有 RDMA 方案。

机器之心
7

Claude用户退订潮!被指高峰期偷换缩水模型,工程师列9罪状呼吁全网退订

Claude出现危机,AI工程师带头呼吁退订,列9罪状,如高峰时段偷换缩水模型等。不少用户退订,转投OpenAI Codex,其使用量激增。这也让国产模型等获更多尝试,CLI AI编程模式受重视。

量子位
算法论文8

不靠海量数据,如何精准喂养模型?上交Data Whisperer:免训练数据选择法,10%数据逼近全量效果

上海交通学等团队提出 Data Whisperer,首个免训练的注意力驱动数据选择框架。它利用模型身能力打分挑数据,无需训练与人工标注,用 10% 数据让微调效果逼近全量数据,在多方面领先传统方法。

机器之心
8

现实版“盗梦空间”?欧洲极客论文全网爆火,一战戳破三巨头安全神话,35万机密在公网裸奔

欧洲两位安全研究员的论文《从专有 LLM API 中窃取推理轨迹》爆火。他们揭示 OpenAI、Anthropic 和 Google 用的“无状态架构”有漏洞,能利用小模型解码模型推理轨迹,导致隐私泄露等风险。

AI科技大本营
开源动态8

断网可用!首款全双工全模态模型技术报告发布,附一键安装包

面壁智能等联合发布MiniCPM-o 4.5技术报告,它是业界首个端到端全双工全模态模型,采用Omni - Flow架构。同步推出在线Demo、API、端侧安装包等,低显存GPU即可运行,性能表现优秀,应用潜力

新智元
算法论文8

别被室内基准高分骗了:模型是在推理空间,还是在「背答案」?

2025年,空间智能成模型竞争新热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院学等机构发布OSI - Bench重新审视模型空间能力,评测显示当前提升可能是虚假繁荣。

机器之心
新闻资讯8

全球顶尖模型一夜惨遭血洗!最难测试人类拿满分,AI第一名得0.2%分

全球最难AGI测试ARC - AGI - 3上线,人类满分通关,最强模型Opus 4.6仅得0.2%。测试从静态题变为互动游戏,评分看效率。前沿模型得分低,非LLM方案表现更好,AI缺乏元认知能力。

新智元
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现模型高效端到端长时记忆

机器之心发布文章介绍,模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的模型长时记忆框架。

机器之心