自适应解析」共找到 331 篇相关文章

算法论文8

腾讯提出SPO,告别Group

腾讯团队提出Single - stream Policy Optimization(SPO),回归单流策略梯度范式,解决组基方法瓶颈。它有多项亮点,如告别组同步、采用自适应价值跟踪等,在实验中提升了模型性能和训练吞吐。

深度学习自然语言处理
开源动态7

从browser-use 出发,品 Agent 实现

本文作者以学习总结视角,从browser - use出发解析Agent实现。介绍LLM不同阶段,阐述Agent记忆、规划、工具等要素,通过对话演示和源码分析展示运行机制,还探讨MCP集成和Coze space应用模式。

阿里云开发者
推荐文章7

彻底说清 Human-in-the-Loop:企业级 Agent 系统的关键挑战与LangGraph解法【上】

文章围绕企业级Agent系统中Human-in-the-Loop(HITL)展开,介绍其必要性、常见模式,以LangGraph为框架解读关键挑战与实践,涵盖核心机制、原理解析,还阐述HITL下工具调用的两种管控模式。

AI大模型应用实践
产品应用7

Karpathy头疼的“AI游戏困境”,被这款15分钟出包的国产神器破解了

8月初Andrej Karpathy指出通用AI做游戏时,LLM无法高效审查工作的弱点。而国产平台Spellcaster能先解析自然语言确定游戏设计,15分钟出包,还内置测试员验证,团队想工程化落地新方向。

AI寒武纪
算法论文8

VLM会描述视频,却未必用对参考图:RefCaptioner让参考图与视频语义精准对应

多模态大模型处理多参考图与视频对应关系能力不足。为此提出 RefCaptioner,强化模型对参考图识别感应能力、优化输出格式与奖励函数;还构建 MRVBench 评测基准,实验显示其表现优异。

机器之心
推荐文章8

揭秘大模型Steering:从底层机理到系统评估,全面破解大模型行为控制之谜

近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙大联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。

机器之心
产品应用7

苹果推出 Ferret-UI Lite:一款用于查看和控制 UI 的端侧 AI 模型

苹果推出 30 亿参数的 Ferret-UI Lite 端侧 AI 模型,可解析屏幕图像、与应用交互。现有 GUI 智能体方法存在建模复杂等问题,Ferret-UI Lite 性能有竞争力,训练采用两阶段流程,还给出应用建议。

InfoQ
开源动态7

智普入局OCR! GLM-OCR 0.9B 也杀进来了~

OCR是上古任务,如今大模型纷纷入局,用1B以下小参数模型搅动解析市场。GLM-OCR能做文本识别等,采用三级架构,有两阶段流水线及训练机制创新,在多场景表现出色。

CourseAI
新闻资讯8

性能比肩Gemini 3 Pro!昨晚,阿里千问最强模型来了

1月26日深夜,阿里千问旗舰推理模型Qwen3 - Max - Thinking上线,综合性能对标GPT - 5.2与Gemini 3 Pro。它突破传统推理方式,有自适应工具调用能力,助其在企业级AI竞争中领先。

机器之心
推荐文章7

LLM for AIOps:是泡沫还是银弹?智能运维的争议、破局与未来

大模型浪潮下,LLM Agent 在运维领域既被寄予厚望,也饱受争议。「AI 进化论」第六期直播聚焦此话题,阿里云冯富秋和云杉网络向阳从痛点、破局、未来规划解析 LLM 与 OS 协同之道。

InfoQ