「多智能体大语言模型」共找到 9542 篇相关文章
第二代PPTAgent来了!中科院软件所开源首个本地通用幻灯片智能体,9B参数打平GPT-5
中科院软件所开源第二代PPTAgent -- DeepPresenter,将幻灯片智能体模型与智能体沙箱环境一同开源。它解决了AI制作PPT的痛点,以9B参数打平GPT - 5,在消费级显卡上有出色表现。
清华叉院教授手把手教你用强化学习训练智能体
在大模型智能体时代,智能体强化学习训练通用智能体很关键。ASearcher 是相关项目,AReaL 有交互次数和代码设计优势。本次吴翼教授将带团队成员,以多轮搜索智能体为例,教用最少代码实现训练。
The Batch: 896 | 教会模型说出真相
大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。
只需1/4预算,性能反超基线:阿里高德提出Tree-GRPO,高效破解智能体RL难题
阿里高德提出Tree - GRPO方法解决智能体RL难题。它以智能体步骤为节点树搜索,在11个数据集中更省预算、表现更好,能在1/4预算超GRPO基线,解决了Rollout成本高和监督稀疏问题。
MiniCPM 4.0来了!220倍极速狂飙,端侧模型的比赛,结束了
面壁智能联合清华发布MiniCPM 4.0,极限场景220倍加速。它是首个原生稀疏模型,有三级火箭推理加速体系,性能强,适配全平台,应用广泛,或成端侧AI分水岭。
从被吐槽“套壳中国大模型”到自研封神!首次揭秘Cursor背后极速代码Agent如何对标GPT5.1 Codex,生成效率提4倍
10月29日,Cursor 2.0发布Composer大模型,效率约为其他模型四倍。开发者分享其成极速代码Agent方法,如强化学习、平衡训练与推理负载等,还提及未来方向及研发反思。
医疗大模型的中国战局:谁在打,打到哪了
中国医药AI赛道已有三家公司上市,是大模型赛道唯一跑通商业化闭环的方向。介绍了各梯队企业情况,分析百川智能技术领先但商业化待证明,还对2026年医药AI赛道给出关键判断。
横扫19项榜单!大晓机器人开源全球首创空间智能底座
大晓机器人联合多机构推出通用基础模型“ACE - Brain - 0”并全行业开源。它打破本体壁垒,在24个核心benchmark中19个获SOTA成绩,应用于机器狗,还提出新训练范式,统一四大能力,重新定义通用具身智能。
让小爱音箱超越「指令-响应」模式,开启真正智能交互新时代
2017年智能音箱诞生,却被困于「指令 - 响应」模式。此次Open - XiaoAI进化,接管小爱音箱“耳朵”和“嘴巴”,通过多模态大模型和AI Agent释放其潜力,还给出项目运行教程等。
清华校友赵晟佳,出任Meta超级智能首席科学家!GPT-4核心功臣,和LeCun平起平坐
Meta宣布清华校友赵晟佳担任超级智能实验室首席科学家。他是ChatGPT、GPT - 4等模型核心贡献者。Meta为组团队不遗余力,还准备超大规模算力,与OpenAI等的AI竞争白热化。