「元脑智能体工作站Z3」共找到 3929 篇相关文章
荣登HuggingFace周榜首位, 人大高瓴与快手提出ARPO实现智能体高效训练!
人大高瓴与快手提出的ARPO项目受高度关注,荣登Huggingface Paper日榜、周榜双首位。它是为多轮交互型LLM智能体设计的强化学习算法,在基准测试中,用一半工具调用预算就显著优于现有方法。
CVPR 2026 Workshop征稿|第六届AdvML@CV:多模态大模型智能体安全
IEEE/CVF 计算机视觉与模式识别会议 CVPR 2026 6月3 - 7日在美国丹佛举办,期间6月3或4日将举办第六届对抗机器学习计算机视觉研讨会,聚焦视觉 - 语言智能体安全,现开启论文征稿并公布重要日期,给出投稿入口。
腾讯混元团队最新研究:让 AI 从「固定模型」走向「实时适配系统」
腾讯混元团队提出论文《HY-WU (Part I)》,尝试让模型在推理阶段根据输入实时动态生成适合任务的参数,而非依赖固定参数。通过多类实验验证,这种方式在图像编辑等任务中有明显优势,还降低了训练复杂度。
达摩院推出多智能体框架ReasonMed,打造医学推理数据生成新范式
在人工智能领域,推理语言模型在医学场景应用存在挑战,达摩院推出多智能体框架ReasonMed,提出医学推理数据生成新范式,开源百万级高质量数据集ReasonMed370K,验证了‘小模型 + 高质量数据’的潜力。
4K-Agent:可将低分辨率图像提升至4K高清智能体
图像超分辨率技术在多种视觉任务中重要,但传统方法泛化能力有限。德克萨斯A&M等大学研究人员推出4K Agent,其多智能体架构能将低分辨率图像提至4K高清,在多领域测试表现出色。
社区供稿 | GLM-4.5技术博客:原生融合推理、编码和智能体能力
文章介绍 GLM-4.5 和 GLM-4.5-Air,二者旨在统一推理、编码和智能体能力。在 12 个基准测试中表现良好,采用 MoE 架构等技术,还开源 slime 框架。文中展示其多方面应用,并说明使用方式。
“图片秒生”,腾讯混元图像2.0模型正式发布,主打速度和真实感
5月16日,腾讯发布混元图像2.0模型,率先实现实时生图,生图速度快、质量高,能避免‘AI味’。在GenEval基准上准确率超95%,还发布实时绘画板功能,后续将推原生多模态模型。
Agent Skill 开发者大赛总决赛圆满落幕,共探智能体技术落地新未来
2026年5月22日,Agent Skill开发者大赛总决赛在上海举办,采用双轨模式,38支队伍参赛,覆盖多元场景。大赛由多社区主办、多单位协办,揭晓企业组、高校组特等奖等,推动智能体技术落地。
AI 智能体实战:100+次迭代后的意图识别提升之道
文章围绕AI智能体意图识别与槽位抽取展开,介绍初级到高阶四种方案。初级方案简单高效但意图多易出错;中级解耦架构,适用于复杂场景;进阶用RAG召回解决意图识别不准;高阶应对多轮对话挑战,各有优劣。
Demo的高估值时代结束了,具身智能开始按生产力重新算账
WAIC后具身智能进入冷静期,融资热但投资人关注点转变。过去‘PPT估值、Demo定价’,如今按生产力算账。分析了高估值由来、发展路径类似大模型,还给出衡量企业的四把尺子,并以酷哇科技为例说明。