「效率瓶颈」共找到 1720 篇相关文章
Transformer上限触顶,Mobius能否引发下一代模型架构的革命?
自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。
博士80小时熬夜改代码,Codex 2小时交卷!科研奇点来了
近日,Agentic AI工程师Dan McAteer实验发现,OpenAI Codex的Goal Mode完成机械可解释性研究任务,效率比博士高40倍。Codex /goal模式能自主循环,契合科研流程。此外,递归自我改进证据涌现,AGI或早已实现。
不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化
随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。
大模型进入研发体系后,我们看到了这些变化
InfoQ《极客有约》X AICon 直播邀请同程、网易、百度工程师,探讨大模型入研发体系的变化。涉及提效、协作、角色分工等方面,还谈及工程师特质、效率焦虑、岗位数量等问题,6 月北京 AICon 大会将深入交流。
Jeff Dean最新访谈:基础模型越来越强,小团队如何与谷歌等巨头竞争?
Jeff Dean 在 Y Combinator 活动中与 Diana Hu 对谈,探讨 AI 创业者面临的问题。他指出推理成新瓶颈,预计有更多推理硬件;Agent 执行复杂任务进步快;小团队可找 1%成功率问题;还提及稀缺能力及创业建议。
更大,还能更快,更准!蚂蚁开源万亿参数语言模型Ling-1T,刷新多项SOTA
10月9日,蚂蚁开源万亿参数语言模型Ling-1T。它延续自研高效MoE架构,在编程、数学推理等多维度测试表现亮眼,还能兼顾精确与效率。此外,它在多场景实用性强,其创新设计提升了能效比与性能。
GPT-5被批过度炒作、性能落后,OpenAI联创揭秘其中原因:我们把它关在 “象牙塔”,和现实世界接触不够
OpenAI发布GPT - 5后遭遇波折,因被批不直观恢复为GPT - 4。但它是进军企业市场举措,获部分企业认可。OpenAI联合创始人Greg Brockman谈其发展历程、瓶颈、应用等,强调让模型接触现实、提升安全性及适配团队工作。
智谱清言微服务架构转型实践——基于 CloudWeGo 的技术演进
本文由智谱清言资深后端开发工程师肖文彬整理,阐述其从单体架构到微服务体系的转型实践。随着业务发展,传统单体架构显瓶颈,智谱清言开启转型,分享挑战、架构设计、技术选型等经验,为相关团队提供借鉴。
ICML 2025 Spotlight | 多模态大模型暴露短板?EMMA基准深度揭秘多模态推理能力
最新研究推出 EMMA 基准测试,揭示顶尖多模态大语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。
API7.ai创始人温铭:烧了几百亿Token,我用AI重写了生产级网关,总结出6条经验
API7.ai创始人温铭分享用AI重写生产级网关经验。他认为AI编码能力超资深工程师,瓶颈在人。还介绍在公司‘禁手写代码’的情况,以及AI代码审查、使用阶段等内容,最后说明重写AI网关AISIX的原因。