10GW算力」共找到 1282 篇相关文章

算法论文8

LightMem用3招重新设计了LLM的记忆,结果出乎意料

LLM在超长多轮对话中有上下文窗口有限、记忆系统昂贵的痛点。LightMem借鉴人类记忆机制,用三招重新设计LLM记忆,实验显示其准确率超基线,还降低token使用量、API调用和运行时间。

PaperAgent
新闻资讯8

超级AI云,未来10年阿里云的核心战略 | 甲子光年

9月24日,阿里云CEO吴泳铭在云栖大会给出发展方向,要成全栈人工智能服务商。其All in AI,构建云基础设施、开源通义千问、布局Agent应用,按三阶段演进路线迈向ASI,还将加大投入提升数据中心能耗。

甲子光年
开源动态8

IBM推出轻量多模态文档神器!OCR与QA超GPT-4o,识别率高达98%!

日常文档处理麻烦,现有工具或体积大、算力消耗高,或识别精度不够。IBM 开源轻量多模态文档处理模型 Granite - Docling,仅258M参数,性能超 GPT - 4o,适用于多场景。

开源星探
新闻资讯8

谷歌与OpenAI同获ICPC 2025金牌!GPT-5满分夺冠,Gemini攻破人类队伍都没解出的难题

ICPC是计算机程序设计领域的“奥林匹克”。今年GPT - 5满分、Gemini 2.5 Deep Think解10题,达金牌水准,超越人类强队,标志AI在算法竞赛“超车”,证明其具备临场推理等能力。

AI科技大本营
新闻资讯7

他们在1993年就提出了Scaling Law

原来,Scaling Law在32年前就被提出了,不是2020年的OpenAI、不是2017年的百度,而是1993年的贝尔实验室。在一篇文章里提出一种预测方法,研究人员可以预测模型在更大数据集上的表现,这和现在大家常提的Scaling Law几乎一致。

量子位
新闻资讯7

每天熬到凌晨、没有人规划、全靠“能干就干”!离职员工爆料:OpenAI Codex 就是这样“卷”出来的

《连线》称 OpenAI 研究员 Jason Wei 等将加盟 Meta。离职员工 Calvin French - Owen 分享在 OpenAI 经历,揭秘其自下而上研究文化、扩张问题、成本结构等,还讲述 Codex 开发情况。

InfoQ
产品应用8

华为版《黑客帝国》首次亮相:训推复杂AI前先“彩排”,小时级预演万卡集群

华为首次亮相数字化风洞虚拟环境平台,可在训推复杂AI模型前“彩排”,小时级预演万卡集群。其包含Sim2Train、Sim2Infer、Sim2Availability,分别解决训练、推理、高可用问题。

量子位
产品应用8

昇腾+鲲鹏联手上大招!华为爆改MoE训练,吞吐再飙升20%,内存省70%

最近华为在MoE训练系统给出算子和内存优化新方案,三大核心算子全面提速,系统吞吐再提20%,Selective R/S实现内存节省70%,为大规模MoE模型训练扫清障碍。

新智元
新闻资讯7

2025年哪款模型最受欢迎?Poe最新报告:DeepSeek降温、可灵成黑马

AI工具聚合平台Poe发布2025年1 - 5月人工智能模型使用趋势报告。显示模型市场份额消长明显,推理模型势头正劲,图像、视频、音频生成领域各有竞争态势,如DeepSeek降温,可灵成视频生成黑马。

Founder Park
新闻资讯7

“额度想重置就重置,不问财务”,Codex Tibo首曝幕后:产品没做好,就补偿用户

围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。

InfoQ