「人类行为模拟」共找到 1574 篇相关文章
图灵奖得主Sutton再突破:强化学习在控制问题上媲美深度强化学习?
图灵奖得主Richard S. Sutton认为未来AI发展需靠强化学习。他将2024年的SwiftTD算法拓展到控制领域,提出Swift - Sarsa算法,还设计操作性条件反射基准测试。实验显示,结合预处理方法,其性能或媲美深度强化学习。
模仿学习新范式!Chain-of-Action:轨迹自回归实现动作推理
具身智能领域尚未迎来「GPT时刻」,现有模仿学习范式有缺陷。字节跳动与阿德莱德大学研究者提出「动作链」(CoA)策略,通过轨迹自回归建模解决累计误差,提升泛化性,实验效果显著。
MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents
MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents,将交易任务分解为专业角色,含分析师、研究员等。介绍了安装、CLI使用、包的实现细节等,还提及项目地址。
Sam Altman最新博文!温和的奇点
OpenAI CEO Sam Altman在新博客《The Gentle Singularity》中探讨AI进步远超想象时世界的变化,提及AI将在多方面做贡献,还给出未来几年AI发展预测,指出要解决安全和对齐问题。
刚刚!OpenAI正式官宣调整公司结构:奥特曼发全员信承认AGI会由多家公司实现
OpenAI宣布调整公司结构,非营利组织继续控制,盈利实体转型公益企业(PBC),采用常规股权结构,非营利组织成PBC大股东。Sam Altman称这非出售,是结构简化调整,目标是让AGI惠及全人类。
突发,Claude首破黎曼猜想新纪录!
Anthropic让内部研究版Claude证明「黎曼猜想」失败,但它将符合猜想的黎曼Zeta函数零点比例下限从41.6%提升到67.2%。此成果意义重大,标志AI进入开放数学研究。
后Scaling Law时期的模型、token和组织 | 5Y Quarterly
文章是五源2026年第二季度回顾,涵盖对AI多方面观察,如token军备竞赛、模型资产价值、公司组织成护城河等,还提及被投企业上市、融资情况及五源资本获多项行业荣誉。
让机器人学会“预判接触”:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题
它石智航联合四大顶尖机构发布论文“TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在精细操作领域取得关键进展。
太意外!教皇和Anthropic创始人,要联袂开发布会
5月26日,教宗利奥十四世将发布通谕《Magnifica Humanitas》聚焦「AI时代对人的保护」,Anthropic联合创始人Chris Olah受邀。梵蒂冈同步成立AI委员会。但有人质疑这是道德外包或公关道具,全球也缺乏有效约束AI发展的机制。
5.1K Star!Codebuff 把整个 AI 编程团队装进你的终端!
Codebuff是开源AI编程助手,获超5.1k stars。其多智能体架构让不同智能体分工协作,理解代码上下文更好、编辑更准。官方测试中完成率61%,超Claude Code。它免费且上手简单,还能创建自定义智能体。