经验学习」共找到 1812 篇相关文章

新闻资讯7

扒开1604份招聘,DeepSeek们最狠的大招藏在招人里

Epoch AI调查6家中国AI公司1604个岗位,发现中国AI公司用人不重资历重能力,岗位集中在北京、杭州、上海,不同公司有不同业务侧重和发展方向,招聘启事暴露其战略布局。

新智元
算法论文8

从最优传输角度训练奖励模型:让 RLHF 学会「忽略错误偏好」丨ICML 2026

浙江大学、小红书、北京大学等团队提出SelectiveRM,基于最优传输训练奖励模型。它重构训练目标,通过选择性分布对齐排除噪声偏好,解决了奖励模型训练中监督信号不可靠的问题,实验验证其有效且泛化能力好。

AI科技评论
产品应用8

Claude Code 最佳实践:从「能用」到「用得好」的 15 个关键技巧

GitHub热门仓库‘claude - code - best - practice’拆透Claude Code用法。本文提炼其精华,结合经验给出实操指南,涵盖上下文管理、CLAUDE.md设置、子代理等15个关键技巧,助你用好Claude Code。

AI Reading Hub
算法论文8

ACL 2026 | OPeRA Dataset: LLM真的能模仿人类行为了吗?首次系统评估LLM的人类行为模拟能力

美国东北大学等机构研究者提出OPeRA数据集,采集真实用户在线购物行为,支持系统评测LLM个体化行为预测能力。实验显示当前主流LLM在模拟人类行为上表现有限,揭示其能力边界。

机器之心
推荐文章7

前 YC 创始人:在家带四娃,还跑着 11 个 AI Agent

前 YC 创始人现为全职妈妈,带四个娃同时运行 11 个 AI Agent,将其融入家庭教育与生活。分享 Agent 搭建经验、遇的问题及教训,还预测 AI 会逆转生育率下降趋势。

特工宇宙
开源动态8

字节最火的开源Agent项目,如何思考Agent的自我进化?

4月5日,LangChain创始人Harrison Chase阐述对Agent自我进化的思考,认为Agent系统可在Model、Harness、Context三层持续进化。知名开源框架DeerFlow联合作者Daniel也补充了团队思考。

Founder Park
新闻资讯7

蚂蚁阿福:从 0 到生产的医疗 Agent 工程化落地|QCon 北京

4月16 - 18日,QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题。蚂蚁集团郭春晓将分享《蚂蚁阿福:从0到生产的医疗Agent工程化落地》,探讨技术体系与布局,还有20多个专题论坛。

InfoQ
推荐文章8

硬核拆解 Hermes-Agent:自学习 Skill 机制的架构设计与实现原理。

文章围绕Hermes - Agent展开,指出多数Agent缺乏自学习能力,而它试图跨越这一鸿沟,能自动“写手册”(Skill)。介绍其架构、安装配置,通过代码审计任务演示自学习过程,并解析Skill机制,为生产级Agent提供新思路。

AI大模型应用实践
新闻资讯8

OpenAI推出GPT-5.4 mini/nano;MiniMax发布M2.7;小米发布MiMo-V2系列模型

OpenAI、MiniMax、小米陆续发布新模型。OpenAI推GPT - 5.4 mini与nano,优化速度和成本;MiniMax的M2.7能自我演化;小米MiMo - V2系列覆盖智能体核心、全模态理解和情感语音合成。

AIGC开放社区
算法论文8

如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程

丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。

机器之心