语言分析」共找到 2139 篇相关文章

开源动态8

妈妈再也不用担心延迟了!斯坦福手搓Llama超级内核,推理仅需0.00068秒

斯坦福Hazy实验室推出低延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。

新智元
算法论文7

SOTA大模型遇上加密数据评测:Qwen3未破10%,o1也栽了丨上海AI Lab等联合研究

当前推理模型在基准测试中性能卓越,但在密码学领域推理能力待探索。上海AI Lab等推出CipherBank评测,用海量真实隐私场景数据和多类型密码算法挑战SOTA大模型,结果显示模型表现不佳,还分析了模型“犯难”原因。

量子位
算法论文8

Agent可以自己进化了?!

论文《Automated Design of Agentic Systems》提出让Agent扮演设计师,“元代理”能自动生成新代理设计方案。用编程语言作设计空间,实现“设计自由”。实战中,AI设计的Agent全领域超越人类,还具备知识迁移能力,未来或有自主进化的AI生态。

深度学习自然语言处理
算法论文8

突破多模态奖励瓶颈!中科院清华快手联合提出R1-Reward,用强化学习赋予模型长期推理能力

多模态奖励模型(MRMs)对提升多模态大语言模型表现至关重要,强化学习理论上可引入长期推理能力,但现有RL算法用于训练MRM会不稳定。中科院、清华等团队推出R1 - Reward模型,在多模态奖励模型benchmark上有显著提升。

量子位
推荐文章8

GPT-4o图像生成的「核燃料」找到了!万字长文拆解潜在变量,网友:原来AI在另一个维度作画

上月,GPT - 4o图像生成功能爆火。Sander Dielman在博客中探讨生成模型利用潜在空间提高效率和质量,将潜在变量比作「数据精髓」,深入对比多种模型,还介绍训练方法、损失函数等,兼具理论深度与直观洞察。

机器之心
产品应用7

给 AI 一张陶罐碎片图,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测

文章实测 MiniMax H3 和 Seedance 2.0 Fast,给模型一张破碎陶罐图,让其生成破碎过程视频。分析 H3 技术逻辑,对比两模型效率、质感和物理细节等差异,指出开放与闭源模型的特点及视频模型待解决的问题。

AI科技评论
开源动态7

The Batch: 948 | GLM 5.1:面向长时任务的能力提升

Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。

DeeplearningAI
新闻资讯7

刷屏的SBTI,底层算法有点东西…

近期SBTI人格测试爆火,它出自B站UP主Q肉儿串儿,初衷是劝朋友戒酒。经分析,它大概率是“人工主导+AI辅助”的产物,技术架构简单,算法逻辑是答题拆维度、分数归档、模板匹配。此外,还有大神网友推出MBAI版测试题。

量子位
新闻资讯7

王智、沈今晶、方汉、郑林等等都来了,AIFUT大会Day2上午场全记录。

AIFUT大会第二天上午场精彩纷呈。AJ谈900万人共建AI社区历程;王智、沈今晶探讨AI与电影创作;方汉称一人公司时代到来,分析难被替代的五种人;郑林谈影视成本与未来趋势;李勇提出AI玩具应是朋友。

数字生命卡兹克
算法论文8

RL特训出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘

近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。

新智元