大模型应用」共找到 10092 篇相关文章

算法论文8

上交 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
算法论文8

GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」

模型推理能力难迁移到小模型,现有强化学习方法如GRPO在小模型上性能提升有限。香港中文学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。

机器之心
产品应用8

一个模型场景通吃!它石智航AWE3.7的泛化能力有点狠

长期以来,机器人系统多依赖专有模型,场景变化时需重新训练。如今具身智能步入下半场,它石智航通用具身模型AWE3.7用同一颗“具身脑”贯通多场景,回应了通用泛化命题。

量子位
产品应用7

模型已经够聪明了,为什么 95% 的 AI 项目还是跑不出 ROI?

2026年AI落地现悖论,模型能力强但多数项目难有ROI,原因是数据未准备好。腾讯云在AI产业应用会宣布升级全栈数据平台,推出DataBuddy,可在多场景实现对话即交付,解决数据问题助力AI落地。

InfoQ
算法论文7

POF|清华学张宇飞团队:采用数据驱动湍流模型的三维增升装置模拟

传统RANS方法预测分离流动有挑战,数据驱动湍流模型泛化性能有局限。清华学张宇飞团队研究其在复杂三维增升装置应用,验证SST - CND模型泛化能力及修正项迁移能力,证明其可用于真实工程流动问题。

力学与人工智能
推荐文章8

被轻视的巨市场,厂做不好的Local Agent为何难?| 甲子光年

文章指出模型边际收益递减,AI竞赛规则生变,产业从‘参数竞赛’转向‘效率革命’。本地Agent有潜力,但主流产品体验差。GreenBitAI深耕低比特模型,推出Libra,有望撬开万亿美元增量市场。

甲子光年
算法论文7

DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO

文章围绕语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。

机器之心
算法论文8

Qwen团队发布长上下文Reasoning模型QwenLong-L1,超越o3-mini

Qwen团队发布长上下文Reasoning模型QwenLong - L1。当前模型处理长文本有训练效率低、过程不稳定难题。QwenLong - L1用分阶段强化学习等方法,实验中超越o3 - mini、比肩Claude,还在案例表现出色。

深度学习自然语言处理
开源动态7

DeepSeek R1/V3作者开源轻量级vLLM,1200行代码读懂模型推理技术!

DeepSeek R1/V3作者俞星凯开源轻量级vLLM——Nano - vLLM。它有快速离线推理、代码可读、含优化套件等特性,还给出了RTX 4070等硬件和Qwen3 - 0.6B模型的基准测试配置。

PaperAgent
新闻资讯7

全国首部AI智能体应用评估标准,现公开征集起草单位和个人

随着模型热潮进入深水区,企业急需业务智能体,但因缺乏可量化评估标准,AI智能体应用面临选型、验收、优化困境。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草工作,现公开征集起草单位和个人。

开源先锋