「多智能体技术」共找到 8166 篇相关文章

算法论文8

DPad: 扩散大语言模型的中庸之道,杜克大学陈怡然团队免训推理加速61倍

扩散大语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克大学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。

机器之心
开源动态8

最窒息的Bug:Agent循环搜索原地打转?SGR Agent用「双阶段认知」破局

Hybrid Schema - Guided Reasoning(SGR)是革命性AI研究智能体框架,用「两阶段推理 - 执行架构」和「持久化上下文记忆系统」,解决AI助手复杂研究任务的三大痛点,模拟人类研究过程,适用于多场景。

CourseAI
开源动态8

文档秒变演讲视频还带配音!开源Agent商业报告/学术论文接近人类水平

澳大利亚和英国多所高校团队提出多模态智能体PresentAgent,能将文档转化为配有语音讲解和同步幻灯片的视频演示。其模块化生成框架有可控性和领域适应性,评估显示它在各指标上接近人类水平。

量子位
算法论文8

数学推理热潮下的冷思考!如何训练真正"全能"的推理模型?

论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定能力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智能体提供新路径。

深度学习自然语言处理
产品应用7

我把Claude变成了带记忆的人生教练,结果它比我还了解我自己|人生教练 Agent v2.1

作者将Claude打造成带记忆的人生教练,记忆功能让教练能回顾过往对话。其技术栈不复杂,相比传统教练优势明显。虽有缺乏情感共鸣等局限,但能发现认知盲区,未来有改进空间。

AI 产品自由
开源动态8

重磅开源!首个全异步强化学习训练系统来了,SOTA推理大模型RL训练提速2.77倍

清华大学和蚂蚁技术研究院联合团队开源全异步强化学习训练系统 AReaL-boba²,坚持“全面开源、极速训练、深度可定制”理念,实现异步 RL 训练,训练速度最高提升 2.77 倍,支持多轮智能体强化学习训练。

机器之心
开源动态8

太顺手啦,这款开源框架让AI助手秒级接入应用,狂揽20.5K星!再见繁琐AI开发

CopilotKit是基于React的开源框架,开发者能以极简代码将智能助手集成到Web应用。它有三分钟集成、场景感知等优势,具备五大核心功能,适用于多场景,三步即可入门,比同类项目更有优势。

小华同学ai
算法论文8

AI长身体,直接做实验!自主通用科学家,科研界的Scaling Law来了

本文探讨未来科研范式「自主通用科学家」(AGS),它将AI与机器人技术结合实现科研全流程自动化,有望突破人类科研限制,引发科学范式变革,还介绍了相关架构、优势及面临的挑战和应对策略。

新智元
算法论文8

LeCun世界模型:48倍规划速度,单卡就能跑

Yann LeCun团队推出LeWorldModel世界模型,仅靠两条数学规则,让机器几小时学会物理运转逻辑,动作规划速度超同类48倍。它跳出复杂训练修补怪圈,单卡训练,在多环境测试表现出色,还展现对物理法则的深刻理解。

AIGC开放社区
开源动态8

李飞飞50亿美金赛道被开源!浙大教授章国锋带队创业,打造无限时长实时3D世界模型

2024年李飞飞创立的World Labs入局空间智能赛道,估值达50亿美元。近日影溯发布并开源实时帧生成模型InSpatio - WorldFM,由章国锋领衔,该模型突破2D局限,效率高、能无限时长推理,展现出高工程可用性。

机器之心