「推理质量」共找到 2602 篇相关文章
内存股集体大跌,原因竟是谷歌这篇一年前的论文
美国内存股集体暴跌,诱因是谷歌新博客介绍一年前公布的技术 TurboQuant。它是压缩算法,可大幅减少 LLM KV 缓存内存占用、提升速度且精度零损失,有望打乱市场对内存芯片增长预期。
英伟达GPU全系列硬核科普手册:一文读懂NVIDIA芯片的定位、规格与应用场景
这是英伟达GPU全系列硬核科普手册,覆盖消费级、工作站、推理卡、训练卡及中国特供版五大产品线,讲清区别与用法,还介绍架构演进、命名规则等,助读者秒变选型高手。
Kimi新架构让马斯克叹服!17岁高中生作者一战成名
17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。
EAAI | 西工大夏明坤,张伟伟等:分层无量纲学习:一种物理和数据混合驱动的无量纲关联参数提取方法
在流体力学研究中,高维数据冗余增加模型分析复杂度。本文提出分层无量纲学习方法(Hi - π),通过物理、压缩、映射三层架构自动提取关键无量纲参数组合,在多个算例中表现良好,为参数降维与知识发现提供新思路。
GPT-5.4发布:OpenAI首个大一统模型,简直是龙虾原生
OpenAI发布GPT - 5.4,这是其首个大一统模型,将推理、编程等能力融合,且单项性能领先。它在知识工作、计算机使用、编程调试等能力提升,定位AI数字员工,虽单价高但有省钱机制。
Vibe Coding 再升级,做世界顶尖的 Agentic Engineering!
过去18个月,AI Coding工具从‘辅助补全’到‘独立编程’质变,决定Agent产出质量核心变量从模型能力转向工程系统。文章探讨工程师角色迁移、Context Engineering、对抗Agent缺陷、长期维护及发展路径等问题。
国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测
文章深度实测MiniMax-M2.5编程能力,用其开发多款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。
大模型桌游试玩员来了:用五大画像模拟「千人千面」,评分精准度超越GPT-5.1
盛大东京研究院等团队提出MeepleLM,首个能模拟玩家视角给出建设性批评的虚拟试玩模型。它构建专属数据集,引入MDA理论,提炼五种玩家画像。实验显示其评分精准度超GPT - 5.1等通用模型。
BigQuery 新功能:SQL 直调 17 万 + AI 模型,3800 万行数据处理成本仅 2 美元
Google为BigQuery推出面向开源模型的第三方生成式AI推理功能,允许数据团队用SQL语句部署运行Hugging Face或Vertex AI Model Garden的模型,消除对独立ML基础设施的需求,解决数据团队痛点。
中国AI登顶全球之巅,顶流女团MV燃爆开场!AI音乐奇点已至
昆仑天工发布Mureka V8音乐大模型,基于MusiCoT技术,在音乐性、人声表现力和编曲层次等方面显著提升,使AI音乐达「可发布」级别,评测超Suno V5,还与太合音乐合作,欲打造全球AI音乐第一平台。