性能拐点」共找到 1966 篇相关文章

开源动态8

RAG2.0进入“即插即用”时代!清华YAML+MCP让复杂RAG秒变“乐高”

检索增强生成系统(RAG)复杂度提升,开发者面临高昂工程成本。基于MCP架构的UltraRAG 2.0框架,让科研人员用YAML文件声明复杂逻辑,降低技术门槛与学习成本,还提升了复杂多跳问题性能

CourseAI
产品应用8

The Batch:827 | Claude 4 推动代码生成能力再升级

Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。

DeeplearningAI
开源动态8

SGLang-Diffusion: 两个月进展

自2025年11月初发布,SGLang - Diffusion获广泛关注。过去两月持续优化,速度提升1.5倍。介绍新模型支持、LoRA支持等进展,还展示性能测试结果,阐述关键改进及未来规划。

GiantPandaLLM
新闻资讯7

直播预约 | 迈向用于演绎推理的诚实语言模型

本次讲座聚焦迈向用于演绎推理的诚实语言模型。当前语言模型难诚实推理,输入不足会产生无根据答案。为此制定多步骤任务,提出强化学习方法ACNCHOR,稳定学习过程、提高推理性能

深度学习自然语言处理
开源动态8

深度拆解,硬核解构,揭开vLLM推理系统实现高效吞吐的秘籍

文章深度拆解 vLLM 推理系统,介绍其核心组件和高级特性,包括推理引擎流程、调度机制、高级功能等,还提及系统扩展、分布式部署、性能测量等内容,助力读者理解推理引擎工作原理。

机器之心
算法论文8

ICML 2025 | 打破残差连接瓶颈,彩云科技&北邮提出MUDDFormer架构让Transformer再进化!

彩云科技与北邮联合提出多路动态稠密连接(MUDD)替代残差连接,提升Transformer跨层信息传递效率。实验显示,采用该架构的模型性能显著提升,论文等均已公开。

机器之心
算法论文8

ICML 2025 Spotlight|南洋理工陶大程教授团队等提出基于RAG的高分辨率图像感知框架,准确率提高20%

南洋理工陶大程教授团队等合作,为解决多模态大语言模型处理高分辨率图像问题,探索 RAG 应用可行性,提出 Retrieval-Augmented Perception (RAP) 框架,在多任务上提升性能,已被 ICML 2025 接收。

机器之心
新闻资讯7

刚刚,Cursor 版 Github 上线

昨天 GitHub 宕机,Cursor 团队趁势宣布代码托管平台 Origin 面向付费用户推 Beta 版。Origin 为 Agent 规模工作流设计,有代码仓库管理等功能,性能数据挑衅,此前曾提前曝光又撤回。

AGI Hunt
产品应用8

刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude

阿里巴巴突袭发布新一代基座大模型Qwen3.8 - Max,它总参数量达2.4万亿,在多场景表现出色,在权威榜单冲进全球第一梯队,性能直逼Claude,且价格实惠,实测反馈良好。

量子位
推荐文章8

「一页纸」吃透产业链之:人形机器人,Figure链与特斯拉Optimus链

文章聚焦人形机器人,分析其产业处于量产落地拐点,2025 - 2026年是关键期。介绍产业链上中下游情况,指出面临的软硬件挑战,还提及市场规模、主要参与者,重点关注Figure与特斯拉Optimus产业链。

芯师爷