代理执行」共找到 716 篇相关文章

算法论文8

告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代

大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。

深度学习自然语言处理
7

5个月内失败十几次,几人团队在压力下做出爆款App!网友:AI时代懂人性比懂技术更重要

社交应用 Candle 上线六个月用户破 30 万、月营收超 15 万美元。其创始人出身大厂,此前项目遇困境,后受人际关系问题启发推出该应用,主打维护亲密关系,还面临留存和体验挑战。AI 时代小团队创业也有机会。

InfoQ
推荐文章8

2 亿美元 ARR,AI 语音赛道最会赚钱的公司,ElevenLabs 如何做到快速增长?

AI音频独角兽ElevenLabs估值66亿美元,从“小公司”成长为独角兽。其CEO回顾创业历程,分享心得,如结合研发与产品、融资绑定产品动态、靠三点优势不被OpenAI取代等,还谈及人才、融资、业务等方面策略。

Founder Park
推荐文章8

深度解析大模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景

大模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。

腾讯技术工程
推荐文章7

2026年必须搞懂的20个 Agent 工程概念(运行机制篇):大白话一次讲清。

文章聚焦Agent工程运行机制,介绍20个核心概念。如Agent与ChatBot区别在于会‘做’;Harness是模型运行框架;Execution Model决定思考行动范式等,还给出各概念工程实践建议。

AI大模型应用实践
算法论文8

满分的「差」,Qwen与复旦等揭示编程智能体奖励设计的结构性困境

Qwen团队与复旦等联合发表论文《The Verification Horizon: No Silver Bullet for Coding Agent Rewards》,指出编码智能体奖励设计存在结构性困境,任何奖励信号只是人类意图的‘替身’,验证需成系统与智能体协同演化,并研究多种验证者。

机器之心
新闻资讯7

深度访谈|OpenClaw引爆Agent元年,AI Agent在企业内如何规模化应用?

2026年初,开源智能体项目OpenClaw爆火,让AI从“对话框里的顾问”变为“现实世界中的执行者”。本文围绕“从OpenClaw爆火到企业级Agent落地”展开,探讨AI Agent的应用问题、开源生态格局等,还给出企业部署建议。

InfoQ
推荐文章7

数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图

文章借Snowflake分享,探讨数据从业者在AI时代的核心能力。介绍AI从工具到执行者的进化,指出数据叙事成稀缺技能,还给出普通职场人90天AI逆袭路线图,强调人类在决策判断上的不可替代性。

InfoQ
推荐文章8

Harness is the New Dataset:模型智能提升的下一个关键方向

文章指出当基模能力成熟,决定 agent 上限的是围绕模型搭建的系统,即 harness engineering。介绍其组件、设计原则,探讨模型与 harness 关系,还列举创业机会项目,最后推测下一范式是 Coordination Engineering。

海外独角兽
产品应用8

前荣耀AI实验室主任带队:用“超级大脑”接管农场,24小时不打烊

浙江丘沃智能的AlphaFarm系统开启无人农场新范式,由前荣耀AI实验室主任汤泳等“AI极客”打造。该系统能自主决策执行、实时监控,有四大黑科技,经评估在农业垂直领域领先。

量子位