「算力资源」共找到 1127 篇相关文章
长上下文快2.9倍,解码快6倍:Kimi 用线性注意力实现性能与效率双突破
月之暗面团队的Kimi Linear模型,是混合线性注意力架构,核心是Kimi Delta Attention模块。它解决线性注意力的记忆及遗忘问题,在多任务测试表现出色,还开源相关资源,推动高效长上下文模型研究。
腾讯与中科院联合提出R-4B,一个能自动决定是否思考的多模态大模型
多模态大语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在多评测中达SoTA,省资源且效果好。
英伟达放话:小模型才是Agent的未来!
英伟达论文指出,当前用大模型构建AI Agent是资源浪费,提出小模型才是Agentic AI未来,给出三点理由,还提供从大模型迁移到小模型的六步流程,并分析三个开源项目,呼吁行业追求效能。
永别了,Sora!奥特曼All in超级App
OpenAI一早关停爆火仅6个月的AI视频APP Sora,包括其开发者版本及ChatGPT内视频功能。奥特曼此举是为打造「超级应用」、为IPO铺路,同时为新模型Spud腾出算力,其预训练已完成,将在未来几周发布。
Anthropic逼急奥特曼:自砍副业,死磕Claude主场
OpenAI最高层拉响「红色警报」,准备砍掉边缘项目,全面退守编程与企业市场主赛道。此前其「全面押注」策略导致资源内耗,而Anthropic专注企业和编程市场取得成功,Claude Code年化收入超25亿美元。OpenAI反击,Codex用户量提升。
The Batch: 919 | 本地 AI 能否替代云端?
大语言模型预测输出需求推动数据中心扩建,研究人员探讨本地小型模型能否分担算力负荷。斯坦福与Together AI团队研究发现,本地系统单瓦特智能量与云端有差距但在缩小,若准确率相近可节省能耗。
《AI大模型与异构算力融合技术白皮书》正式发布
10月10日,中科算网等联合发布《AI大模型与异构算力融合技术白皮书》,聚焦大模型开发痛点,为开发者提供技术参考。白皮书介绍全球大模型发展概况、应用场景拓展、算力需求与挑战,指出异构算力成主流趋势。
2026年OpenAI最看好的3个方向
OpenAI首席财务官与投资人聊2026年AI趋势,涉及多智能体登场、算力换收入、大模型能力突破等。还谈到对医疗、具身智能行业变革影响,破除AI泡沫说法,预测机器人行业前景等。
云计算一哥10分钟发了25个新品!Kimi和MiniMax首次上桌
亚马逊云科技CEO在re:Invent 2025上10分钟发25个新品,2小时近40个。围绕AI Agent,从算力到模型、平台、应用全面布局,还引入中国Kimi和MiniMax,构建全栈壁垒,助力企业用好AI。
清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源
清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。