通用推理系统」共找到 4097 篇相关文章

算法论文8

LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力

来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理

机器之心
推荐文章7

Anthropic实践发现:Multi-Agent系统的核心仍然是Prompt设计!

近期Anthropic分享构建多智能体研究系统最佳实践,提出8条研究智能体的提示工程与评估原则。其架构采用协调者 - 工作者模式,与传统RAG方法不同,使用多步骤搜索动态查找信息。

PaperAgent
8

分布式事务:共识之外,分布式系统状态管理的另一大基石

文章深入探讨分布式系统中“共识”与“事务”的区别与协同,介绍分布式事务的应用场景、实现范式、隔离级别,还阐述 MVCC 机制及其在并发控制、版本存储等方面的应用,最后调研业界数据库产品的事务实现。

阿里云开发者
开源动态7

DeepSeek推理再提速80%,V4正式版定档7月中旬

DeepSeek两天前开源DSpark推理加速框架,已在V4预览版在线服务跑真实流量,使生成速度提升60% - 85%。DSpark化解推测解码问题,在多模型超Eagle3和DFlash。V4正式版7月中旬上线,将引入峰谷定价。

AIGC开放社区
开源动态8

Transformers v5 中的分词系统:更简洁、更清晰、更模块化

文章聚焦 Transformers v5 分词系统,介绍分词概念、流程、主流算法,对比 transformers 和 tokenizers 库。着重讲 v5 改进,如架构与词表分离,解决 v4 黑盒问题,还能从零训练专属分词器。

Hugging Face
新闻资讯8

华为+DeepSeek,推理性能创新高!技术报告也公布出来了

华为昇腾在部署超大规模MoE时推理性能创新高,全面超越英伟达Hopper架构。其采用‘以数学补物理’方式,还将全面开源。团队从多方面优化,在不同硬件上取得优异性能,本周还将举办技术披露周。

量子位
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型

现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心
算法论文8

推理速度飙升5倍,苹果提出全新Multi-Token生成框架!

自回归语言模型逐词生成文本拖慢推理速度、限制并行能力。Apple提出全新框架,挖掘其对未来词元“先验知识”,通过多项技术并行预测多词元,微调预训练模型可显著提速且不损输出质量。

PaperAgent
算法论文7

SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%

文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。

CourseAI
新闻资讯8

刚刚,AMD、OpenAI联合发布超强AI芯片,推理提升35倍

今天凌晨,AMD举办2025全球AI发展大会,与OpenAI联合发布Instinct MI400、Instinct MI350系列超强AI芯片。MI350推理性能提升35倍,MI400内存配置大幅提升。AMD还开源ROCm7平台,7大AI平台与其合作。

AIGC开放社区