「多代理场景」共找到 5408 篇相关文章
全球医疗榜第一,中国AI杀疯了!医疗AI迈入Harness时代
火爆的Harness架构在医疗圈落地,智诊科技发布面向医疗健康行业的Agent OS平台WiseClaw 2.0。它以健康档案为核心,有三层流水线等设计,适用于多场景,且在模型、中层能力和上层治理有优势,还获融资加速发展。
ROLL:面向大规模语言模型的高效强化学习框架
本文介绍阿里推出的ROLL强化学习框架,专为LLM训练优化。它设计灵活,不同用户可用其满足业务、探索或线上指标需求。在多任务训练中性能出色,还采用创新机制提升效率,支持自定义操作,适合学术和业务场景。
MCP 核心宝典 | 2025 最新最全!经典MCP案例实操讲解!必读!
文章介绍2025最新版MCP说明手册,阐述MCP是让AI模型无缝交互的标准化接口和框架,解决AI与外部连接难题。还给出实操案例,如本地构建MCP项目、实现MCP驱动的代理式RAG搜索向量数据库。
MiniMax M2.7国服第一!龙虾自我进化,海外开发者疯狂刷屏
MiniMax M2.7发布后在全球开发者社区引发巨大反响,在PinchBench榜单上拿下全球第四、国产第一。它具备多智能体协作、自进化等能力,在代码、办公、科研等场景表现出色,还推出开源项目OpenRoom。
姚顺雨Agent能力交卷!腾讯混元Hy3把元宝练成了打工人
腾讯混元Hy3正式版发布,总参数295B、激活参数21B,最大支持256K上下文。它是快慢思考融合的MoE模型,重点提升Coding和Agent能力。其加持下,元宝大升级,能完成办公、生活等多场景任务。
3D VLA新范式!CVPR冠军方案BridgeVLA,真机性能提升32%
中科院自动化所提出BridgeVLA模型,将3D输入投影为2D图像并利用2D热图进行动作预测。它训练分两阶段,在多仿真基准和真机实验表现卓越,仅3条轨迹基础任务成功率达96.8%,真机性能提升32%。
完全离线!开源实时语音识别神器,本地实时语音转文字,秒级延迟+说话人识别!
实时语音转文字和说话人识别需求渐长,但传统工具多依赖云端,有隐私与延迟问题。GitHub上的开源项目WhisperLiveKit是本地化语音识别方案,速度快、延迟低、支持说话人识别,适合会议等场景。
深度视角 | 物理法则如何“纠偏”AI黑盒?首篇社会物理学引导的深度学习(SGDL)综述深度解析
近日,清华等多机构发布全球首篇SGDL系统性综述。文章介绍SGDL诞生背景、核心架构、应用场景,探讨其与大模型结合潜力,也指出面临的挑战,认为其是思维范式跃迁,正构建智能社会蓝图。
龙虾创始人深夜点赞:百度 DuMate,打工人的 AI 搭子
文章介绍百度新上线的产品 DuMate,它被定位为首个「国产企业级满血版 OpenClaw」。安装简单,能深度集成百度工具生态,部署方便且安全。通过多场景实测,其任务完成度高,是打工人实用的 AI 搭子。
对话范浩强:10亿融资之前,我们手搓了5000元“丐版硬件”
原力灵机是具身智能新秀,9个月连融3轮获阿里数亿投资。其创始团队多出自旷视,从To B工业场景切入物流行业。公司发布开源三件套,还将开源基座模型,强调创业要穿越周期,谨慎慢跑。