学习实践」共找到 1864 篇相关文章

新闻资讯8

AI转型最大的门槛,不是技术,是人

浪潮信息董事长彭震在人工智能+生态大会上提出,AI转型最大门槛是人而非技术。他指出组织力不足影响业务效果,提出Humagent概念。浪潮信息还从文化、组织、流程层面推动转型,愿做客户同行者。

量子位
算法论文8

从最优传输角度训练奖励模型:让 RLHF 学会「忽略错误偏好」丨ICML 2026

浙江大学、小红书、北京大学等团队提出SelectiveRM,基于最优传输训练奖励模型。它重构训练目标,通过选择性分布对齐排除噪声偏好,解决了奖励模型训练中监督信号不可靠的问题,实验验证其有效且泛化能力好。

AI科技评论
算法论文8

ACL 2026 | OPeRA Dataset: LLM真的能模仿人类行为了吗?首次系统评估LLM的人类行为模拟能力

美国东北大学等机构研究者提出OPeRA数据集,采集真实用户在线购物行为,支持系统评测LLM个体化行为预测能力。实验显示当前主流LLM在模拟人类行为上表现有限,揭示其能力边界。

机器之心
开源动态8

字节最火的开源Agent项目,如何思考Agent的自我进化?

4月5日,LangChain创始人Harrison Chase阐述对Agent自我进化的思考,认为Agent系统可在Model、Harness、Context三层持续进化。知名开源框架DeerFlow联合作者Daniel也补充了团队思考。

Founder Park
推荐文章7

详尽地带你从零开始设计实现一个AI Agent框架

文章详尽介绍AI Agent框架,从理论到实践,涵盖多种模式、主流框架对比,强调上下文工程是核心,还给出极简框架实现及应用示例,虽有不足但能助看清Agent本质。

腾讯技术工程
推荐文章8

硬核拆解 Hermes-Agent:自学习 Skill 机制的架构设计与实现原理。

文章围绕Hermes - Agent展开,指出多数Agent缺乏自学习能力,而它试图跨越这一鸿沟,能自动“写手册”(Skill)。介绍其架构、安装配置,通过代码审计任务演示自学习过程,并解析Skill机制,为生产级Agent提供新思路。

AI大模型应用实践
新闻资讯8

OpenAI推出GPT-5.4 mini/nano;MiniMax发布M2.7;小米发布MiMo-V2系列模型

OpenAI、MiniMax、小米陆续发布新模型。OpenAI推GPT - 5.4 mini与nano,优化速度和成本;MiniMax的M2.7能自我演化;小米MiMo - V2系列覆盖智能体核心、全模态理解和情感语音合成。

AIGC开放社区
产品应用7

构建 Claude Code 的经验:我们如何使用 Skills

本文来自Anthropic内部团队,总结构建Claude Code使用Skills的经验。介绍Skills类型,如库与API参考、产品验证等;给出编写技巧,涵盖避免说废话、建踩坑点章节等;还提及分发、管理及衡量效果的方法。

宝玉AI
推荐文章7

Karpathy:IDE没有消亡,我们需要的是更大的IDE

AI时代有人认为IDE要消亡,Andrej Karpathy却觉得IDE不会消亡,只是形态要变,需更大的IDE。他认为编程基本单元变了,还提出智能体组织可被fork,指出人类组织不透明等观点。

AI寒武纪
算法论文8

如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程

丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。

机器之心