Skill训练框架」共找到 3730 篇相关文章

产品应用7

自动化评测的九九归一——评测agent

本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。

阿里云开发者
算法论文8

首篇WebAgents综述:大模型赋能AI Agent,实现下一代Web自动化

互联网任务重复繁琐,香港理工大学研究人员从架构、训练和可信性等角度,总结WebAgents代表性方法,梳理研究进展。WebAgents能根据用户指令完成网页任务,其发展预示人机关系新纪元。

新智元
新闻资讯7

你天天用的Claude和Codex,Meta内部不让随便用了

今年5月Meta给工程师划红线,限制用Claude Code和Codex,因其太好用。Meta组建团队自研编程助手MetaCode,担心外部模型输出渗进训练数据,出现“蒸馏陷阱”,且能省钱。

新智元
产品应用8

重磅!iPhone 端侧可部署 Gemma 4 了!完全零token消耗!

PhoneClaw 是运行在 iPhone 的本地 AI Agent,可离线运行 Google Gemma 4。它支持多模态,有隐私保障和灵活模型管理。文中介绍使用方法、自定义 Skill 方式、常见问题,还提及后续扩展计划。

GitHubStore
算法论文8

让扩散模型「可解释」不再降质,开启图片编辑新思路

过去三年扩散模型席卷图像生成领域,但可解释性研究是‘黑箱’,且现有尝试常致性能下降。香港中文大学与上海人工智能实验室团队提出TIDE框架,可解释且不降质,还带来新图像编辑方式。

机器之心
开源动态8

MCP•RL 开源:让 AI 通过强化学习,自己学会怎么用 MCP 服务器

MCP•RL 是 Agent Reinforcement Trainer (ART) 框架一部分,能让 AI 模型通过强化学习学会高效使用 MCP 服务器,解决工具调用痛点。ART 无需标注数据、通用性强,提供便捷集成方式,项目开源。

AI进修生
产品应用7

超 10 万人都在看!Qwen3重塑文本嵌入与重排序技术版图

文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。

CourseAI
新闻资讯7

姚顺雨提到的「AI下半场」,产品评估仍被误解

OpenAI研究员姚顺雨提出「AI下半场」重点转向定义问题,评估重要性超训练。亚马逊Eugene Yan发文补充,指出产品评估常被误解,应运用科学方法,践行评估驱动开发,自动化工具也需人工监督。

机器之心
推荐文章7

Agent经济,要来了

红杉资本半小时演讲讲清AI产业现状与趋势。介绍了分析框架,指出AI浪潮大且猛,会颠覆软件市场,机会在应用层。还提出Agent经济概念,建议大家抓住机会行动起来。

newtype AI
推荐文章7

AI产业链投资大逻辑:第三集

本集围绕AI产业链投资大逻辑,从底层的电展开。指出AI瓶颈正从GPU扩散到电力,存量核电资产因AI数据中心需求变得值钱,还引出'过渡期与终局'核心判断框架

newtype AI