推理框架开发」共找到 4659 篇相关文章

算法论文8

量化噪声竟是RL秘钥?QeRL:高效强化学习新范式,一场噪声引发的性能革命

近年来,大语言模型在复杂推理任务中面临挑战,强化学习虽更接近人类推理过程,但训练“烧资源”。论文《QeRL》提出量化不仅能压缩模型、节省资源,还能增强模型探索能力,QeRL框架实现训练速度提升、内存占用减半。

深度学习自然语言处理
开源动态8

AI+ Kuikly:7.5小时落地三端「多模态聊天 App」实战

腾讯开源的高性能跨端框架 Kuikly,搭配 AI 开发,仅用 7.5 小时交付一套支持 Android、iOS、鸿蒙三端的 AI 聊天 App。介绍了开发过程,包括环境准备、需求分析、编码实现、集成自测、迭代优化和验收复盘,展示了“AI + Kuikly”的高效。

腾讯技术工程
开源动态8

第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力

新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B长文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。

新智元
推荐文章8

构建会“说话”和“行动”的 AI:生成式数字人技术与 EchoMimic 实践

在 QCon 全球软件开发大会上,支付宝李宇明围绕 EchoMimic 介绍生成式数字人进展、技术、应用及研究思路。对比传统数字人,生成式数字人成本低、易控制,但也有技术新、推理成本高的问题。EchoMimic 两版本已开源,经优化推理速度可提升。

InfoQ
产品应用8

北大出品:全球首个支持生成华为鸿蒙应用的AI Agent来了

华为2025开发者大会上,华为终端CEO何刚点名「码上飞」AI Agent。它利用多智能体系统技术,实现开发全流程自动化,用户用自然语言提需求就能生成应用,实测5分钟可开发出睡眠助手app。

AI寒武纪
推荐文章7

IDE消亡之年?Steve Yegge两句狠话:2026年还用IDE就不行,每天烧500–1000美元Token才合理

Steve Yegge和Gene Kim认为,从2026年1月1日起,依赖传统IDE的工程师会被拉开差距,这是‘生产方式换代’。他们还提到AI将重塑软件开发,无开发或成现实,新开发方式价值更优。

InfoQ
8

重磅发现!大模型的「aha moment」不是装腔作势,内部信息量暴增数倍!

中国人民大学等联合团队研究发现,大模型推理有“信息脉冲”,特定步骤互信息值飙升形成“互信息峰值”,对应“思考词汇”。基于此提出无需额外训练提升推理性能的方法,代码已开源。

机器之心
7

三位哈佛辍学生,如何将专用芯片变成估值百亿美元的 AI 算力公司

文章聚焦 Etched 公司,分析推理成 AI 算力主战场背景,介绍三位哈佛辍学生创始人故事,阐述其从芯片到推理集群的产品打造,还提及团队、文化、资本情况,最后分析竞争格局与前景。

投资实习所
推荐文章7

agent未来落地的收敛形态

当前agent开发变重,基模优化与agent开发脱钩。后续落地的技术收敛范式是将基模训练和agent开发有机结合,有模型更小、agent更智能、基模深入业务场景带来新想象力等好处。

Agent的潜意识
推荐文章7

业务逻辑的“坍塌”:当应用层只剩下胶水代码,在 AI Agent 时代,我们该构建什么

作者梳理从“怀疑AI”到“理解并驾驭AI”的心路,探讨LLM不确定性、AI开发概念,手搓Agent示例介绍开发关键点,分析LangChain价值,思考混合架构,还从性能视角看LLM,回顾其关键跃迁。

阿里云开发者