「优化问题」共找到 4136 篇相关文章
谷歌Gemini一次提示能耗≈看9秒电视,专家:别太信,有误导性
谷歌报告称处理一个中位数的Gemini文本提示能耗低,2024 - 2025年单个文本提示能耗降33倍、碳足迹减44倍,归功于全栈式优化。但专家质疑其方法论,指出未算间接用水、碳排放核算不全等问题。
6位前DeepMind老将打造「AI指挥官」,一半成本刷新SOTA
6名前Google DeepMind成员创立Poetiq,搭建元系统让前沿大模型自动生成解决特定任务的策略和模型组合,降低推理成本。其Gemini 3 Pro优化技术在ARC - AGI - 2上创SOTA,成本仅为之前最优方法一半。
GPT-5核心推手闪电跳槽,Anthropic CEO高调炫耀员工留存碾压OpenAI,“AI第一公司”光环崩塌?
OpenAI后训练负责人、GPT - 5核心推手Max Schwarzer跳槽至Anthropic,此前也有多位技术领袖离开。OpenAI在商业版图扩张与伦理争议并存下,正从参数军备赛转向体验护城河,同时加速商业与政治布局,但面临人才流失等问题。
32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世
现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。
陶哲轩说:AI 辅助数学证明,已经成了日常操作
世界顶级数学家陶哲轩解决 Erdős 经典问题时,全流程用 AI 做助手,从证明草案到简化证明,再到形式化验证。整个流程为人类提出猜想、AI 暴力证明、人类简化优化、AI 辅助形式化验证。
谷歌Gemini | 一次提示能耗≈看9秒电视剧?
谷歌发布Gemini能源消耗研究报告,称处理中位数文本提示能耗低,2024 - 2025年能耗降33倍、碳足迹减44倍,归功于全栈式优化。但专家质疑方法论,指出未算间接用水、碳排放核算不全等问题。
Gödel Rescheduler:适用于云原生系统的全局最优重调度框架
本文介绍字节跳动研发的Gödel Rescheduler重调度框架,它能解决传统调度资源分配和任务摆放问题。阐述传统重调度弊端,介绍新方案组件,列举应用场景及成果,还提及未来规划,目前已开源。
推理成本太高、算力不够用?单纯堆卡没用,得靠极致的“压缩”与“调度” | AICon
大模型落地面临推理成本高、算力需求大的问题。AICon大会上,阿里云刘峥、ModelTC龚睿昊、阿里巴巴马腾、OPPO宋晓辉、清程极智汤雄超等专家将分享从压缩到调度的推理优化方案,覆盖云到边缘、多算力平台。
Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存?
普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。
卡帕西都整破防了:AI Coding没门槛,可部署环节真嗯啊的难
AI Coding界明星卡帕西公开吐槽,代码不再是AI编程瓶颈,部署才是。他以自己开发「菜单图片生成器」的经历为例,指出部署环节问题频发。他认为应让AI调用和配置,还推荐了Stripe Projects等优化产品。