多Agent体系」共找到 6399 篇相关文章

开源动态8

开源即爆火!英伟达重磅推出OmniVinci全模态大模型

英伟达在华盛顿GTC大会开源OmniVinci全模态大语言模型,实现视觉、音频、语言统一理解。它性能超竞品,架构有创新,数据引擎庞大。实验有重要洞察,在场景表现佳,代表全新AI范式。

机器之心
算法论文8

基于DINOv2和SAM2改进的U-Net模型

DSU-Net是基于DINOv2和SAM2改进的U-Net模型,通过尺度跨模型特征协作和轻量级适配器模块,解决现有图像分割模型在特定下游任务表现不足问题,提升分割精度,降低训练成本。

机器学习AI算法工程
新闻资讯7

Claude Opus 4.1火速发布!坐稳编程之王,官方:马上还有大更新

Claude Opus 4.1正式发布,编程性能超Claude Opus 4及竞品,拿下SOTA。在Agent任务和推理方面升级,定价不变。官方将在几周内大规模改进。Anthropic借客户背书,暗秀关系,文风受开发者喜爱。

量子位
算法论文8

首个GUI模态大模型智能体可信评测框架+基准:MLA-Trust

MLA-Trust 是首个针对 GUI 环境下模态大模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。

机器之心
开源动态8

文心大模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心大模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。可在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新,性能表现优。

AI前线
开源动态8

让视觉语言模型像o3一样动手搜索、写代码!Visual ARFT实现模态智能体能力

上海交大等团队推出模态智能体训练方法 Visual-ARFT,让视觉语言模型有「工具智能体」能力,还开源项目。它能自动调用工具、拆解任务,团队构建 MAT-Bench 评测,其在任务超 GPT-4o。

机器之心
新闻资讯9

TR35亚太区入选者名单揭晓!他们是未来创新议程的制定者

本文是《麻省理工科技评论》正式发布2026年度“35岁以下科技创新35人”(TR35)亚太区入选名单,介绍了位入选青年创新者在AI、生物医学、材料、能源等领域的突破性成果,展现亚太青年创新的交叉化、落地化趋势。

DeepTech深科技
新闻资讯7

独家 | 破壳机器人完成亿美元级融资:「操作」才是具身落地的最大挑战

AI科技评论获悉,通用具身智能公司破壳机器人完成亿美元级Pre - A轮融资。其聚焦机器人操作能力,采用“WAM×RL×DATA”飞轮体系实现快速迭代,还推进软硬件联合研发探索具身落地。

AI科技评论
推荐文章7

端侧跑大模型,现在也太简单了

作者Vicki Boykis分享本地运行AI模型体验,指出如今本地模型性能提升大,像GPT - OSS、Gemma 4系列表现出色。还介绍运行本地智能体流程的设置,虽有问题,但优势,生态值得投资。

机器之心
新闻资讯7

Q:Lab · 龙虾季 | 直播预告

InfoQ 中国推出「Q:Lab」AI 产品测评直播栏目,第一季「龙虾季」聚焦 AI Agent 产品,共 3 期直播,覆盖 9 款核心产品,每期围绕真实职业场景测评,由一线从业者操作并现场出结果。

InfoQ