「多智能体推理能力」共找到 7095 篇相关文章

开源动态7

LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析

文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍了该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述了数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式。

GiantPandaLLM
新闻资讯8

全球第一AI科学家天团,首战封神!2.5个月找到治盲新药,医学圈震撼

世界首个AI科学家天团发布首个成果,2.5个月发现治疗失明新药。AI包办写论文全过程,人类只需执行实验。团队推出全自动化多智能体系统Robin,将开源代码,它可跨领域应用,标志科研新范式诞生。

新智元
开源动态7

24B模型编程超DeepSeek全家桶,32G内存苹果电脑就能跑,专门针对真实GitHub Issue训练

Mistral发布最新开源编程模型Devstral,参数24B,能在单卡RTX4090甚至32G内存Mac上运行。它专为编程智能体推出,针对真实GitHub Issue训练,在SWE - Bench Verified测试中表现出色,还可与All Hands AI框架配合。

量子位
新闻资讯7

微软最新财报:总营收701亿美元,云与AI业务增长强劲

微软发布2025财年第三季度财报,营收701亿美元,同比增13%。生产力与业务流程、智能云、个人计算等业务均有增长,云业务营收424亿美元,同比增20%。董事长称云与AI是关键,CFO表示业绩强劲。

AIGC开放社区
新闻资讯9

突发,Claude刷新物理学世界纪录!单挑基于杨振宁理论9圈难题

本文报道Anthropic的Claude攻克理论物理前沿难题,成功算出平面N=4超杨-米尔斯理论六粒子振幅的九圈结果,打破人类此前保持的八圈纪录,计算成本仅几千美元,展示了大模型在科研领域的突破性能力。

新智元
开源动态8

AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺

ASI-Bench是衡量AI系统科学自主性的基准测试,由多机构联合开发。它能测试AI通用智能、创新性和执行力,通过信息梯度设计,让模型在不同指导量下完成科研任务,结果显示当前AI离自主科研有明显距离。

机器之心
推荐文章7

大模型之外,向量存储如何支撑 Agent 的检索链路

文章指出大模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。

阿里云开发者
产品应用8

阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

8月3日,阿里发布新一代基座大模型Qwen3.8,总参数量2.4万亿,编程和办公能力提升,在权威榜单中表现出色。其API已上线,价格有优势。‘千问办公’公测,Qwen3.8性能强大,还适配阿里真武M890超节点。

InfoQ
新闻资讯7

人大系团队、天使轮数千万元融资,境瞳科技给人类社会建一个「世界模型」

境瞳科技获数千万元天使轮融资,要给人类社会建「世界模型」。其社会模拟器已有超 1350 万个 AI Agent,是全球同类系统中规模最大、置信度最高的。社会智能赛道在硅谷已吸引大量投资,国内境瞳科技是该领域唯一产学研团队。

Founder Park
产品应用8

X-Era蝉联双榜单冠军,引领世界模型未来方向

X-Era的EonWorld在WorldScore和WorldArena两个榜单上连续霸榜。它来自X-Era的VWA原生世界动作模型体系,本职是帮机器人预判世界变化。这为“可用于行动的世界模型”竖起能力线,也揭示行业正进入新阶段。

AI科技评论