效率优化」共找到 2259 篇相关文章

算法论文8

冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世

微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。

机器之心
算法论文7

The Batch:826 | 提高输出准确性的记忆层

通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆层,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。

DeeplearningAI
产品应用7

实战指南:从零构建 MCP 架构下的 Agentic RAG 系统,无第三方MCP Server

五一期间作者用MCP架构从零实现Agentic RAG系统,分享MCP与Agentic RAG融合思考、架构设计,介绍MCP服务端和客户端实现,还做了端到端效果演示,指出架构优势及待优化处。

AI大模型应用实践
产品应用7

腾讯出了个电子管家「马维斯」

腾讯推出操作系统Agent「马维斯」,自带六人团队,能接手各类工作。可深入系统排查问题,实现电脑与云手机协同。有隐私、效率双模式,目前支持Windows和安卓,Mac版在路上。

量子位
开源动态8

Index-AniSora:B站开源动画生成模型,斩获多项SOTA入选IJCAI25

B站开源动画视频生成模型Index - AniSora,支持多种二次元风格视频镜头一键生成。基于AniSora系统,全面提升动画生产效率与质量,开源内容丰富,还构建奖励数据集和奖励模型提升对齐性能。

机器之心
算法论文8

Qwen突破:用「并行计算」代替「堆参数」,新方法内存降22倍、延迟降6倍

LLM进化依赖「堆参数」,存在训练成本高、推理慢等问题。论文提出ParScale,用「并行计算」代替「堆参数」,让模型「分头思考」,推理效率提升22倍,旧模型也能改造,落地价值大。

深度学习自然语言处理
开源动态7

Meta-Harness:让AI 改进自己的Harness

斯坦福IRIS实验室Yoonho Lee团队推出开源框架Meta - Harness,让AI自我优化流程。它像给AI用的‘时间机器’,记录源代码、执行轨迹和评估分数。在任务上表现出色,但也面临耗时、数据爆炸等挑战。

AI工程化
产品应用8

国产算力Day 0适配,一人剧组时代到来,商汤Seko 2.0降本增效让AI短剧真正落地

商汤Seko 2.0率先实现创编一体与多剧集智能生成,通过一致性控制技术与国产算力适配,缩短漫剧制作周期。它解决了AI视频生成痛点,降低成本、提升效率,适配国产芯片,还拓展了内容生态。

AIGC开放社区
开源动态7

DeepSeek悄悄开源LPLB:用线性规划解决MoE负载不均

昨天,DeepSeek 在 GitHub 上线新代码库 LPLB 解决 MoE 负载不均。它利用线性规划算法优化专家并行工作负载分配,能处理动态波动,但也存在忽略非线性成本等局限,对 MoE 架构训练加速有参考价值。

机器之心
产品应用7

从天价咨询到免费AI,夸克能改变志愿填报这门生意吗?

高考报志愿难题一直存在,天价咨询服务并非人人能享。夸克推出国内首个高考志愿大模型,免费生成志愿报告。它能理解复杂规则、把握考生需求,经多阶段训练优化,还搭载高考知识库,产品体验简便。

量子位