大模型Agentic推理框架」共找到 9595 篇相关文章

产品应用8

马斯克悄悄改了战场:Grok Build 0.2.60 剑指 Agent Runtime

2026年6月21日,Grok Build发布0.2.60版本更新,未推新模型能力,而是聚焦Runtime细节,针对会话难恢复、长任务易卡住、工具输出易污染上下文等痛点优化,让Agent更稳定可靠。

AI科技评论
新闻资讯8

GTC 巅峰对话 Jeff Dean x Bill Dally:预训练范式已死、延迟瓶颈不在计算、谈透 AI 五年未来 | GTC 2026

GTC 2026上,NVIDIA首席科学家Bill Dally和Google Jeff Dean展开重磅对话。讨论了模型能力进步、低延迟推理架构、模型自主进化、数据与算力、训练与推理硬件差别等多方面内容,分享对未来AI的看法与见解。

AI科技大本营
算法论文7

拆解大模型几项核心操作背后的数学与 Infra 优化逻辑

文章拆解大模型核心操作(RMSNorm、Softmax、Causal Mask、Sampling)背后的数学与Infra优化逻辑。指出Infra优化是用数学等价变换或精度妥协换硬件利用率和推理速度,还介绍各操作原理、问题及优化方法。

腾讯技术工程
新闻资讯7

OpenAI推理第一人离职,7年打造了o3/o1/GPT-4/Codex

刚开年,OpenAI推理模型第一人Jerry Tworek离职,他在OpenAI近七年,是构建o3、o1、GPT - 4等的关键人物。他称离职是去探索在OpenAI难以开展的研究,网友有感谢赞叹也有因人才流失而沮丧。

量子位
算法论文8

AI模型守法率提升11%,港科大首次用法案构建安全benchmark

香港科技大学KnowComp实验室从法律合规视角研究LLM安全,提出「安全合规」新范式。基于法律条文构建benchmark,用GRPO微调Qwen3 - 8B得推理模型,在新benchmark测试中性能提升显著。

新智元
产品应用8

新晋顶流Agent颠覆设计师!Lovart一手实测来了:是该刷屏爆火

新晋顶流Agent Lovart火爆全网,可一句话搞定专业视觉设计,支持二次编辑。量子位实测其设计能力强,背后是多模型融合调度。它定位人机协作,适合中小企业,官网可申请内测。

量子位
开源动态8

谷歌开源“Agent Skill 超级工具箱”,云、库、引擎、AI全线打通,开发者狂喜

在大模型竞争白热化背景下,谷歌为解决开发者难题推出 Agent Skills。官方仓库含多项技能,涵盖谷歌云核心服务及架构支柱技能,还提供常见任务流程指南,兼容多平台,能省开发代码。此前还有 Addy Osmani 开源的技能库。

InfoQ
新闻资讯8

CSDI峰会开启:Agentic AI 落地应用的黄金期,智能系统重塑生产力

2026年AI从大模型迈向智能体,技术底座爬坡,应用层将爆发。Agentic AI降低构建门槛,行业渗透惊人,未来智能体将重塑生产力,竞争焦点转向生态协同。2026 CSDI峰会10月16 - 18日在深圳召开,共探其应用。

AIGC开放社区
开源动态8

老黄杀入OpenClaw战场!最强开源「龙虾」模型直逼Opus 4.6

英伟达推出新一代开源模型Nemotron 3 Super,专为大规模AI智能体打造,有1200亿参数,推理快、吞吐量高,性能直逼Claude Opus 4.6等。它解决了Agent应用的难题,还开源了相关数据和训练方法。此外,英伟达还在打造NemoClaw开源AI智能体平台。

新智元
算法论文8

基于文本AI的终结?Agent协作可直接「复制思维」,Token效率暴涨

Agentic AI 时代,多智能体系统让 AI 从单打独斗变为团队协作。普林斯顿大学等机构研究者提出多智能体推理框架 LatentMAS,将协作从 token 空间转移到潜在空间,实验显示其性能、效率大幅提升。

机器之心