有限算力」共找到 899 篇相关文章

新闻资讯7

他们在1993年就提出了Scaling Law

原来,Scaling Law在32年前就被提出了,不是2020年的OpenAI、不是2017年的百度,而是1993年的贝尔实验室。在一篇文章里提出一种预测方法,研究人员可以预测模型在更大数据集上的表现,这和现在大家常提的Scaling Law几乎一致。

量子位
新闻资讯7

每天熬到凌晨、没有人规划、全靠“能干就干”!离职员工爆料:OpenAI Codex 就是这样“卷”出来的

《连线》称 OpenAI 研究员 Jason Wei 等将加盟 Meta。离职员工 Calvin French - Owen 分享在 OpenAI 经历,揭秘其自下而上研究文化、扩张问题、成本结构等,还讲述 Codex 开发情况。

InfoQ
产品应用8

华为版《黑客帝国》首次亮相:训推复杂AI前先“彩排”,小时级预演万卡集群

华为首次亮相数字化风洞虚拟环境平台,可在训推复杂AI模型前“彩排”,小时级预演万卡集群。其包含Sim2Train、Sim2Infer、Sim2Availability,分别解决训练、推理、高可用问题。

量子位
算法论文7

多模态推理新基准!最强Gemini 2.5 Pro仅得60分,复旦港中文上海AILab等出品

现有多模态大模型benchmark对逻辑推理理解不足,复旦大学等单位提出MME - Reasoning评估其推理能力。对30 + 模型评测,最优得分仅60%左右,反映出模型多方面推理短板。

量子位
产品应用8

昇腾+鲲鹏联手上大招!华为爆改MoE训练,吞吐再飙升20%,内存省70%

最近华为在MoE训练系统给出算子和内存优化新方案,三大核心算子全面提速,系统吞吐再提20%,Selective R/S实现内存节省70%,为大规模MoE模型训练扫清障碍。

新智元
开源动态8

斩获5.4K star!发现一款轻量快速开源利器,支持插件和主题,非常6!

开源君介绍轻量级文本编辑器`Lite XL`,它用 Lua 编写,基于「lite」优化,安装包仅几 MB,能在多系统流畅运行。其性能出色,还支持插件和主题定制,适合资源有限设备。

开源先锋
新闻资讯7

苦研10年无果,千万经费打水漂!AI黑箱依然无解,谷歌撕破脸

ChatGPT「舔狗化」暴露AI缺乏可解释性,谷歌和Anthropic就「机制可解释性」产生争论。谷歌DeepMind不再将其作研究重点,Anthropic则主张重视。十多年研究成果有限,或应采取「自上而下」研究方式。

新智元
新闻资讯7

“额度想重置就重置,不问财务”,Codex Tibo首曝幕后:产品没做好,就补偿用户

围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。

InfoQ
推荐文章7

所有Harness终将长成“龙虾”,但最后活下来的只有几只

在用户需求驱动下,工具从 LLM 向 Agent、Harness 再到 Claw 自然进化,但用户能容纳的 Claw 有限。Sam Bhagwat 拆解进化路径,指出各阶段核心竞争力,开发者应抢占用户心智空间。

InfoQ
新闻资讯8

ChatGPT那一套要过时了?翁荔实测创业首个模型,回合制AI被“原生实时交互”秒了

Thinking Machines推出交互模型TML - Interaction - Small,可实时接收多模态输入并响应,性能超现有实时系统。该模型未开放,计划先有限预览再广泛发布,若开放将为企业带来巨大价值。

AI前线