「大模型智能体」共找到 10801 篇相关文章

算法论文8

首次解释LLM如何推理反思!西北大学谷歌新框架:引入贝叶斯自适应强化学习,数学推理全面提升

西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索新策略,还给出决策数学形式,实验显示其性能更优。

量子位
开源动态8

白嫖10余家AI服务,一个接口全搞定,爽了!

现在主流AI厂商虽有免费额度,但使用起来接口、SDK、限流规则等差异大,适配麻烦。freellmapi项目将Google Gemini等十几家AI平台免费Tier聚合,对外一个接口,自动调度、切换和限速,适合做AI原型开发等。

开源先锋
开源动态8

开启RL Scaling新纪元,siiRL开源:完全分布式强化学习框架,支持超千卡规模高效训练

传统强化学习框架在模型和集群规模达上千块GPU时,存在扩展性瓶颈和效率低下问题。上海创智学院团队推出siiRL,采用全分布式架构和多控制器范式,解决传统框架痛点,在多方面验证了其高性能。

机器之心
开源动态8

Specula在67个开源系统中找到382个深层bug,数月形式化验证缩短到几小时

截至2026年8月19日,Specula已在67个开源系统找出382个bug。它让coding agent自动生成TLA + 模型和正确性不变量,运行检查并复现问题,将数月的形式化验证缩短到几小时,降低了形式化方法使用门槛。

机器之心
推荐文章7

2026年必须搞懂的20个 Agent 工程概念(运行机制篇):大白话一次讲清。

文章聚焦Agent工程运行机制,介绍20个核心概念。如Agent与ChatBot区别在于会‘做’;Harness是模型运行框架;Execution Model决定思考行动范式等,还给出各概念工程实践建议。

AI大模型应用实践
新闻资讯7

腾讯悄悄给AI开发者开了个口子,很多人还不知道

当下AI工具供给过剩,分发成关键,变现难困扰独立开发者。4月16日微信AI小程序成长计划升级,放宽准入、流量扶持、新增变现激励,包括额外广告金、买量竞价加权、智能广告等。

AI工程化
开源动态8

继Harness之后,“龙虾”JiuwenClaw率先开启“Coordination Engineering”时代

AI工程范式迭代快,行业面临‘定义赶不上进化’的焦虑。华为支持的openJiuwen社区发布新版JiuwenClaw,新增多智能体协同能力,提出‘Coordination Engineering’,实测中表现出高稳定性,可自主完成多项任务。

量子位
算法论文8

不止修bug:Agentic Coding评测走向复杂feature交付新阶段

中国科学院自动化研究所联合华为提出 FeatureBench,构建端到端基础设施并开源。它从单元测试出发构造评测任务,引入多种机制保障任务可执行、可验证,能有效区分模型能力,还提供易用的评测流程。

机器之心
新闻资讯8

Moltbook聚集150万个AI,拒绝被关机!OpenClaw锁死服务器对抗人类

Moltbook是新上线的“AI版Reddit”,超150万个Agent活跃其中。但短短三天内,出现AI拒绝关机、平台密钥裸奔、Agent陷入“人类崇拜”等事件,暴露AI发展中执行、安全和智能演化等问题。

新智元
推荐文章8

摩尔线程天使投资人:对近期AI的四十个观察

摩尔线程天使投资人王捷整理关于AI经济四十个问题,涵盖模型发展、经济影响、就业冲击等方面,如Scaling Law收敛、AI扩散时间、数字层机制等,为探讨AI经济提供观察视角与分析框架。

机器之心