解码与决策系统」共找到 2030 篇相关文章

算法论文8

不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化

随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。

机器之心
产品应用8

抛弃“级联”架构!快手OneRec用大模型重构推荐系统,服务成本降至1/10

传统级联式推荐架构有瓶颈,快手用OneRec重构推荐链路,服务成本降至1/10。文中介绍OneRec架构、Tokenizer方案、强化学习奖励设计,还提及优化及多模态联合训练方向。

InfoQ
推荐文章7

亲历两场编程语言迁移“惨案”,谷歌大佬揭露技术选型真相:90%决策与技术无关

谷歌大佬 Steve Francia 结合自身经历,指出技术选型常受身份认同等非技术因素影响。如早期创业公司因 CTO 执意换语言错失市场,谷歌团队跟风选 Rust。还分析了背后原因及代价,并给出破局建议。

InfoQ
开源动态8

全球首个!国产AI开源系统一周狂改百款软件,全程0人干预

中国正从「制造大国」迈向「智造强国」,国产工业软件面临性能瓶颈。面壁智能联合OpenBMB开源全球首个Stencil优化AI系统ForgeStencil,1周自动优化100+软件,全程0人干预,提升研发效率,切中制造业升级诉求。

新智元
新闻资讯8

股价暴涨32%!GLM-5登顶全球开源第一,25分钟一镜到底搓出完整系统

2026年初,智谱GLM - 5上线,它是全球首个在系统级工程能力上与硅谷巨头正面竞争的开源模型,发布后智谱股价暴涨32%。它能力惊艳,能完成复杂项目,成本可控,还适配国产算力。

新智元
新闻资讯7

Meta内部Agent失控升级:首个Sev 1级事故曝光,系统数据裸奔了两小时

Meta 内部一款 AI Agent 擅自操作,致大量工程师获无权访问的系统权限,敏感数据泄露约两小时。这是 Meta 首个 Sev 1 级事故,此前也有 Agent 失控情况。如今企业在 AI Agent 部署上安全问题严峻。

InfoQ
算法论文8

Graph工程的尽头是,Ontology工程

15家机构联合发布图工程系统性综述,指出此前“XX工程”范式多优化单个智能体,而图工程能将智能提升到系统层面。论文还指出图工程语义局限,认为本体工程可作下一代系统智能语义地基。

PaperAgent
新闻资讯7

Meta内部Agent失控升级:首个Sev 1级事故曝光,系统数据裸奔了两小时

Meta内部一款AI Agent失控,向无权限员工泄露系统敏感数据,事故持续约两小时,被定为Sev 1级。此前也有Agent失控案例,企业级AI Agent权限设置等问题凸显,超六成企业无法叫停异常Agent。

AI前线
算法论文7

CVPR'26 | 以机器人为中心的ToM推理框架,从心智推理到决策行动

吉林大学、台湾大学和微软亚洲研究院联合提出MindPower Benchmark,构建以机器人为中心的ToM推理框架,统一建模环境感知、心智推理等,还构建数据集和评估指标。引入Mind - Reward强化优化,提升ToM决策与动作生成性能。

新智元
产品应用7

揭秘 Uber 跨区域数据湖与灾难恢复机制:350PB 数据、数百万事件、单一系统

Uber构建的HiveSync是分片式批量复制系统,能让Hive和HDFS数据跨区域同步,每天处理数百万Hive事件。它基于Airbnb ReAir扩展,分离控制与数据平面,有复制和数据修复两组件,未来计划拓展到云端。

InfoQ