麦琪的花园」共找到 10569 篇相关文章

推荐文章7

破局大模型推理困局!华为张君详解昇腾“融合算力”优化秘籍

华为高级开发工程师张君在AICon大会演讲,围绕大模型推理优化,从模型、框架、算子层展开,结合案例阐述技术方案。分析大模型推理现状挑战,介绍加速技术,分享昇腾硬件算子优化实践及通算融合算子优化方法。

InfoQ
算法论文7

进攻是最好防守:超级平台为何「不得不」对AI智能体出手?

上海交通大学团队提出,超级平台“必须”攻击AI智能体,以守住其作为数字流量守门人地位。研究从守门人理论分析反击原因,还阐述平台应对策略、攻击策略特点约束,最后强调要推动建设性技术治理生态。

AI科技评论
开源动态8

Gödel Rescheduler:适用于云原生系统全局最优重调度框架

本文介绍字节跳动研发Gödel Rescheduler重调度框架,它能解决传统调度资源分配和任务摆放问题。阐述传统重调度弊端,介绍新方案组件,列举应用场景及成果,还提及未来规划,目前已开源。

InfoQ
新闻资讯7

AI摧毁就业?DeepMind CEO:这是一场比互联网更猛职业洗牌

谷歌DeepMind CEO Hassabis认为AI虽可能颠覆职场,但会创造新工作,提高生产力。他强调学习STEM、上手AI工具重要性,也指出AI缺乏“安全护栏”,需全球公约监管,还乐观期待AI让人类不再自私。

新智元
算法论文7

模型宣称“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相

近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难原因及面临瓶颈。

深度学习自然语言处理
产品应用7

训练世界模型,开始从人类肌肉和脑子里偷师了

具身智能数据竞争进入新阶段,第一视角视频虽缓解数据量问题,但未记录人行动原因及大脑身体实时修正。FaceMind提出Ego - NeuroLoop数据范式,配套NeuroMatrix和NeuroBooster,将训练数据从“行为库”推向“闭环库”。

量子位
算法论文7

拆解大模型几项核心操作背后数学与 Infra 优化逻辑

文章拆解大模型核心操作(RMSNorm、Softmax、Causal Mask、Sampling)背后数学与Infra优化逻辑。指出Infra优化是用数学等价变换或精度妥协换硬件利用率和推理速度,还介绍各操作原理、问题及优化方法。

腾讯技术工程
产品应用7

从聊天窗口到多 Agent 控制台:一次 AI 编程协作范式转移

作者分享了从单 Agent 协作到多 Agent 协作编程范式转变。当前主流 AI 开发多为单 Agent 协作,效率低,作者设计了 Mexus 工具,解决多 Agent 协作、观测、Review 等问题,重塑人与 AI 协作关系。

阿里云开发者
算法论文8

警惕!大模型成本倒挂:你正在为模型多余「思考」买单

一项来自多所高校和微软研究院研究揭示AI模型价格倒挂现象,低定价模型可能产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据集,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心
新闻资讯8

我们真变成巫师了:OpenAI API 负责人谈 AI 如何重塑软件工程

OpenAI API 负责人 Sherwin Wu 在 Lenny's Podcast 上分享,OpenAI 内部 95% 工程师用 Codex,100% PR 由其审查。他谈了 AI 重塑软件工程现状、未来趋势,提及管理变化、创业效应、部署问题等,也为创业者给出建议。

宝玉AI