「结构化推理」共找到 3017 篇相关文章
推理速度飙升5倍,苹果提出全新Multi-Token生成框架!
自回归语言模型逐词生成文本拖慢推理速度、限制并行能力。Apple提出全新框架,挖掘其对未来词元“先验知识”,通过多项技术并行预测多词元,微调预训练模型可显著提速且不损输出质量。
Agent 护城河:揭秘Harness的三大支柱
上海交大等机构研究者梳理LLM Agent设计逻辑,指出能力正从模型内部流向外部,外部化有记忆、技能、协议三大支柱,Harness负责协调,Agent竞争转向外部化基础设施。
深入体验 A2A SDK:一步步教你构建“服务化”的 Agent 系统
文章基于A2A最新Python - SDK,介绍将LangGraph的Agent通过A2A协议对外暴露并服务的方法,涵盖核心架构、概念、交互流程,以及A2A Server端、Client端实现和测试总结,还提及A2A优势。
SGLang 推理引擎的技术要点与部署实践|AICon 北京站前瞻
SGLang 是开源推理引擎,截至 2025 年 6 月,GitHub 近 15K Stars,月均下载量超 10 万次,被多个行业巨头采纳。InfoQ 专访其核心开发者尹良升,他分享关键技术等内容,6 月 27 - 28 日他将在 AICon 演讲。
实测爆火的阶跃星辰Step 3,性能SOTA,开源多模态推理之王
在 WAIC 2025 前一天,阶跃星辰推出新一代基座模型 Step 3,它是开源 VLM 新晋之王,性能超同类别开源模型,与顶尖闭源 VLM 也有一战之力。该模型具备多开好省特点,还展示了宏大技术生态与商业化布局。
SeePhys Pro:重新审视多模态物理推理中的视觉理解与训练收益
来自中山大学等的研究者提出SeePhys Pro,是面向多模态物理推理的细粒度评测与训练诊断框架。发布了benchmark、训练集等,测评显示当前模型在信息模态转变时不稳定,为模型评测和训练研究提供基础。
当我把 AI 变成一个"算法":Skill 工程化设计的心路历程
作者分享将 Agent 工程化设计的历程。指出 LLM 做 Agent 有痛点,引入 CLI 接管确定性任务和上下文管理,还设计了 Workflow 串联工具,实现自动扩展和无缝互转,最后做 workflow - creator 形成自洽闭环。
To Agent, not Human
软件开发正从面向人类转向面向Agent。作者将newtype内容生产系统CLI化,供Agent使用。当前各种工具CLI化,Skill生态爆发,技术栈含CLI、MCP、Skills、Framework四层。
OpenAI 宣布启动“全国人工智能教育研究院”:美国K-12教育全面AI化
OpenAI宣布与美国教师联合会合作,启动‘全国人工智能教育研究院’,这是为期五年的计划,目标是为全美40万K12教育工作者提供AI培训和支持。OpenAI五年内投入1000万美元,计划在多地建中心。
刚刚,OpenAI开源了两个大模型~
OpenAI开源基于GPT - OSS的安全推理模型GPT - OSS - Safeguard - 120B和GPT - OSS - Safeguard - 20B,用于安全用例。有安全推理训练、自带策略等亮点,适配不同显存,采用宽松许可证。