自奖励训练」共找到 3130 篇相关文章

产品应用8

编程新王Composer 2.5来了,逼近Opus 4.7!成本仅为1/10

Cursor推出全新AI编程模型Composer 2.5,在部分编程基准测试上接近Claude 4.7 Opus和GPT - 5.5,运行效率最高提升10倍,成本仅为竞品一小部分。其采用定向文本反馈RL等机制,还与SpaceXAI合作冲击百万H100集群算力。

新智元
新闻资讯7

让Agent真正“行动”起来,Agent Skill开发者大赛火热报名中!

人工智能下半场聚焦‘行动’,Agent Skill成关键桥梁。为推动AI落地,AIGC开放社区与算泥社区联合主办Agent Skill开发者大赛,设双赛道,官方提供支持,有丰厚奖励,报名通道已开启。

AIGC开放社区
开源动态8

字节最火的开源Agent项目,如何思考Agent的我进化?

4月5日,LangChain创始人Harrison Chase阐述对Agent我进化的思考,认为Agent系统可在Model、Harness、Context三层持续进化。知名开源框架DeerFlow联合作者Daniel也补充了团队思考。

Founder Park
推荐文章7

装了N个skills之后,鹅厂员工觉得“最香”的是哪一个?

文章围绕技能使用展开,介绍鹅厂员工推荐的各类实用技能,如腾讯文档 skill、westock - data、小区避坑神器等,还鼓励读者分享己的宝藏 skill 或想法,关注有奖励

腾讯技术工程
开源动态8

目标更重要?国内公司超越Generalist,进化到动作中心世界模型

具身智能圈被Generalist CEO长文刷屏,其称目标比工具标签重要。但国内极佳世界未停于概念争辩,开源“以动作为中心的世界模型”GigaWorld - Policy,重构具身智能底层逻辑,在多方面表现出色。

机器之心
新闻资讯7

大基金投资,安徽又跑出一家芯片IPO

4月10日,全芯智造IPO辅导状态更新为“辅导验收”。这家成立不到七年的制造类EDA企业,创始人是行业“老兵”倪捷,技术覆盖制造关键环节,虽营收破5亿但净亏超3亿,获大基金等投资,有望推动国产替代。

芯师爷
推荐文章8

硬核拆解 Hermes-Agent:学习 Skill 机制的架构设计与实现原理。

文章围绕Hermes - Agent展开,指出多数Agent缺乏学习能力,而它试图跨越这一鸿沟,能动“写手册”(Skill)。介绍其架构、安装配置,通过代码审计任务演示学习过程,并解析Skill机制,为生产级Agent提供新思路。

AI大模型应用实践
算法论文8

西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026

过去两年视频生成发展近成熟,但多数模型缺乏空间结构稳定建模能力。西湖大学AGI Lab团队提出论文,将问题落回推理阶段,让相机轨迹成约束条件,推进视频生成到三维结构约束建模。

AI科技评论
产品应用7

龙虾连Gemma 4,只需三步,谷歌官方教程出炉,不再花钱买token

谷歌官方发布教程,教大家分三步将 Gemma 4 和龙虾(OpenClaw)连接。有人认为此流程清晰直接,让本地跑 Agent 变得简单。不过 Gemma 4 与顶尖模型有差距,且小模型安全性存疑。

机器之心
新闻资讯7

让Agent真正“行动”起来,Agent Skill开发者大赛正式启动!

人工智能下半场关键词是“行动”,Agent Skill成关键桥梁。Agent Skill开发者大赛今日启动,由AIGC开放社区与算泥社区联合主办,聚焦真实任务执行,设双赛道,官方提供支持,有丰厚奖励

AIGC开放社区