Agent协作机制」共找到 3748 篇相关文章

算法论文8

One RL to See Them All?一个强化学习统一视觉-语言任务!

国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。

机器之心
算法论文7

SGLang Custom AllReduce v1 与 v2 实现原理详解

文章聚焦 SGLang 里两代自定义 all-reduce 实现(v1 和 v2),前者从 vLLM 移植,后者是默认版本。详述其负载特征、前提条件、分发链、同步机制、算法及 CUDA graph 支持等内容,还对比了两代差异,并提及相关环境变量。

GiantPandaLLM
算法论文7

Anthropic最新研究:Claude存在神秘J空间,与人类心智高度相似

Anthropic研究团队在Claude中发现类似人类大脑工作机制的J空间,它存在于模型神经激活中,能让模型默默思考。失去J空间Claude在多步骤推理任务表现变差,还可暴露模型意图,团队已创建演示工具JLens。

AI寒武纪
产品应用8

4秒出百万面!突破千万面精度+12K高清贴图,手握数亿的3D生成公司下一局怎么打?

影眸科技旗下Hyper3D受英伟达青睐。该司完成数亿元融资,发布全新模型Hyper3D Rodin Gen - 2.5,引入类LLM的Thinking机制,4秒生成百万面级模型,还突破千万面精度,搭配12K原生3D贴图模型。

量子位
产品应用8

全球医疗榜第一,中国AI杀疯了!医疗AI迈入Harness时代

火爆的Harness架构在医疗圈落地,智诊科技发布面向医疗健康行业的Agent OS平台WiseClaw 2.0。它以健康档案为核心,有三层流水线等设计,适用于多场景,且在模型、中层能力和上层治理有优势,还获融资加速发展。

新智元
产品应用8

实测!DeepSeek V4-pro是第一个接近Claude开源模型,前Meta研究员震惊

DAIR.AI创始人、前Meta AI研究员Elvis用DeepSeek - V4 - Pro在Pi框架搭LLM知识库,该模型开箱即用,完成知识密集型多步研究任务表现出色,在开源模型里Agent编程和推理能力强,架构设计让推理快且成本低。

AI寒武纪
新闻资讯7

Anthropic最新博客:MCP没有死,我们又救活了。

2个月前Eric Holmes认为MCP已死,因其有Token成本等问题且LLM本就会用命令行。但本周Anthropic发博客称想清MCP定位,它不是替代CLI,而是覆盖其到不了的地方,还给出改进方案,MCP月下载超3亿次。

探索AGI
开源动态7

Karpathy用「harness」彻底终结了RAG。

假期时Karpathy提出llm.wiki想法引发关注。它是元框架,定义人类与AI协作管理知识的方式。与RAG不同,它将新材料关键信息编入已有wiki并持续维护。作者用多种数据测试,发现TextIn API解析效果好,还优化处理流程提升质量。

探索AGI
算法论文8

不止Deep,更要Wide:清华、无问芯穹发布多智能体系统WideSeek-R1,4B模型比肩671B模型!

清华与无问芯穹的RLinf团队提出「广度扩展」,发布多智能体系统WideSeek-R1。它采用「Lead-agent-Subagent」框架,经MARL端到端训练,4B模型在广度搜索任务表现比肩671B模型,且在标准QA任务也出色。

机器之心
产品应用7

Claude Code auto mode 解析:如何用 AI 分类器替代人工审批

Anthropic 发布 Claude Code 的 auto mode 解决审批疲劳问题,用 AI 分类器替代人工审批。介绍了其核心思路、判断危险的标准、两阶段分类等,还分析了漏检率、被拦截后的处理及子 Agent 检查等,也指出了目前局限。

宝玉AI