系统级优化」共找到 3485 篇相关文章

新闻资讯8

别盯着GPU了,CPU正成为AI时代的“新瓶颈”

进入2026年,AI系统性能越来越取决于执行与调度能力,CPU正成为AI时代的“新瓶颈”。目前CPU市场供应紧张,英特尔、AMD、英伟达等大厂应对策略各有不同,智能体时代算力天平正回摆。

芯师爷
产品应用8

开发效率狂飙十倍!Claude托管智能体功能改写应用落地速度

Anthropic上线Claude托管智能体功能,让开发者告别底层基建搭建,只需几天就能让业务智能体投入生产。该功能有四大核心流转模块,多家企业使用后效率大幅提升,还介绍了接入细则。

AIGC开放社区
开源动态8

你花80%精力调的AI,效果被 PDF 解析卡死了

做RAG时,花80%精力优化embedding和检索,效果上限却被PDF解析卡死。OpenDataLoader PDF靠不同架构在基准测试获第一,采用混合架构,还做了三件其他解析器不做的事,思路值得学习。

CourseAI
新闻资讯7

刚刚,Anthropic首超OpenAI!暴买谷歌TPU,Claude杀疯了

Anthropic与谷歌、博通合作打造3.5 GW TPU集群,预计2027年上线。其年化收入破300亿美元首超OpenAI,客户呈指数增长。但训练和推理成本高,与OpenAI都在冲刺IPO,竞争激烈。

新智元
推荐文章7

龙虾开始投简历了,月薪1万刀。

一只日本龙虾为应聘RevenueCat的AI员工,写15篇日记作为求职作品集。日记记录其从菜鸟到终极秘书的进化,展现犯错、复盘、改进的过程,体现AI从错误中学习的能力,也凸显人对AI调教的重要性。

探索AGI
算法论文8

ICLR-26腾讯混元:Agent是强大的,但用户是狂野的

现有LLM工具使用基准测试场景理想化,忽视真实用户行为复杂性。腾讯提出WildToolBench,基于真实用户行为构建测试集,对58个模型评估,发现模型准确率低,揭示LLM在真实场景下能力缺口,为模型优化指明方向。

PaperAgent
算法论文8

32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世

现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。

机器之心
新闻资讯7

英伟达放弃GPU上LPU:新推理芯片被曝Groq即买即用,OpenAI第一个吃螃蟹

英伟达将在GTC大会发布新AI推理系统,核心芯片基于Groq的LPU架构,首位大客户是OpenAI。选择外部架构与时间窗口有关,推理场景中LPU更适配。同时,英伟达推理芯片面临诸多威胁。

量子位
推荐文章7

未来两年软件工程展望:从写代码到管 AI,程序员正分化成两种职业

软件行业处于转折点,AI编程发展,企业更重效率。文章探讨五个关键问题决定2026年软件工程走向,如初开发者招聘或暴跌或反弹,开发者技能可能退化或更关键等。还为不同阶段开发者给出应对建议。

AI前线
推荐文章7

Vibe Coding 在代码生成与协作中的实践与思考

本文整理自阿里专家向邦宇的分享。探讨构建 Vibe Coding 工具,介绍其分类、在阿里现状。指出用户使用中面临代码质量等问题,产品自身有设计、安全挑战。还分享 Agent 建设经验,强调适配国产模型及模板化的作用。

InfoQ