贝叶斯优化技术」共找到 3776 篇相关文章

算法论文8

跨层压缩隐藏状态同时加速TTFT和压缩KV cache!

论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。

机器之心
开源动态8

智谱首秀工程实战经验!Coding Agent日均数亿次调用,GLM-5把长上下文推理的底层问题全逼出来了

今年 2 月智谱 GLM Coding Plan 上线后很受欢迎,随着用户和调用量上涨,Coding Agent 成压力测试场。4 月 30 日智谱发布博客,披露 GLM - 5 系列模型在超大规模 Coding Agent 调用场景下的底层推理技术突破及工程实践经验。

InfoQ
开源动态8

马斯克掀桌子了,最强开源大模型诞生!Grok-2近万亿参数性能首曝

xAI官宣向所有人开源Grok - 2,其有9050亿参数、128k上下文窗口等强大技术规格。还梳理了开源部分、技术特点、权限等,介绍使用方法,网友和大佬高度评价,马斯克预告后续计划。

新智元
算法论文8

微调已死?Agentic上下文工程登场,无需微调实现模型进化

斯坦福大学等团队提出 Agentic Context Engineering 技术,让语言模型无需微调自我提升。它将上下文视为作战手册,引入三种协作角色与三项创新,实验显示其在两类任务上表现优异,成本和延迟显著下降。

机器之心
新闻资讯7

HF Papers直播 AI Insight Talk | OCR 专场

由Hugging Face等联合发起的【AI Insight Talk】系列直播活动第6场 - OCR专场明天开启。将剖析三项技术方案,举办圆桌对谈。还会有嘉宾介绍HunyuanOCR、PaddleOCR - VL、MinerU等模型的技术亮点。

Hugging Face
新闻资讯8

Karpathy新思考:别把AI当动物,它们是全新的智能物种

Andrej Karpathy发长推提出颠覆性观点,认为人们用错误框架理解AI,对比了动物智能与LLM智能的优化动力、根本差异等,强调优化目标决定智能形态,指出应按其机制对待AI。

AI工程化
新闻资讯7

All in AI 两年,AI 代码采纳率突破 50%!安克创新龚银:AI 平台一旦过时,我们会毫不犹豫重构

安克创新2023年决定All in AI,探索适配内部运营与新的产品形态。这两年有项目放弃也有成果,如代码采纳率突破50%。其评估AI落地可行性关注业务、技术、团队成熟度,还采取差异化管理应对创新的ROI问题。

InfoQ
推荐文章8

从 AI 取数到智能分析:企业级数据 Agent 的多阶段演进与工程化落地

文章整理自 Shopee 技术专家王新波在 QCon 全球软件开发大会 2026 北京站的分享。复盘团队打造企业级 Data Agent 实践,揭示技术演进路径,分享将取数工具雕琢为智能分析工具的方法。

InfoQ
算法论文8

均值至上假繁荣!北大新作专挑难题,逼出AI模型真本事

当强化学习成大模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北大团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三大任务表现优异。

新智元
产品应用8

华为升级行业Agent算法架构!MindScale自己写prompt和工作流,KV Cache减少5.7倍token

华为诺亚方舟实验室更新面向行业应用的算法包MindScale,融合算法创新与业务实践经验。它梳理了Agent时代技术挑战,给出技术论文与昇腾代码,应对工作流维护等难题,还提升训推效率、适配国产硬件。

量子位