「推理性能优化」共找到 4188 篇相关文章
DeepSeek识图模式全量上线,却认不出自家老板梁文锋
端午节前,DeepSeek全量推送识图模式。测试发现,它能认出黄仁勋,但忽略‘豆汁’字样,识别人物和潦草汉字准确率低,不过识别文物能力不错。还比较了与其他模型在乐理推理测试中的表现,开发者有新疑问待解答。
小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek
小米开源 MiMo-V2.5 和 MiMo-V2.5-Pro 两款模型,采用 MIT 协议,适合商业应用。在基准测试中表现出色,有竞争力价格和限时优惠。但与 DeepSeek 比,架构创新偏工程化,也有推理表现不足等问题。
腾讯混元团队最新研究:让 AI 从「固定模型」走向「实时适配系统」
腾讯混元团队提出论文《HY-WU (Part I)》,尝试让模型在推理阶段根据输入实时动态生成适合任务的参数,而非依赖固定参数。通过多类实验验证,这种方式在图像编辑等任务中有明显优势,还降低了训练复杂度。
英伟达DLSS 4.5来了:Transformer再进化消除鬼影,“拼好帧”最高提至6倍还能动态调节
CES 2026英伟达在中国媒体见面会介绍了DLSS 4.5,它采用“双核心”策略,画质核心用第二代Transformer模型解决鬼影和闪烁,性能核心支持6倍插帧并能动态调节,还推出G - SYNC Pulsar降低动态模糊。
英伟达韩松团队新作:具有后神经架构搜索的高效语言模型
英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。
刚刚,国产Agent模型闯入全球第一梯队!限时免费
昆仑万维发布SkyClaw-v1.0及其轻量版SkyClaw-v1.0-lite Agent模型,性能达全球第一梯队,价格仅主流顶尖模型一半甚至更低,适配主流Agent框架,还兼容OpenAI接口,现限时免费,后续将逐步开源。
多模态大模型中Attention机制暗藏「骗局」,需用一个公式修正丨上大×南开
上海大学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝会丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。
Meta刚刚开源的SAM 3D火爆全网,未来2D=3D。
近日AI圈热闹,Gemini、GPT、Grok相继更新,Meta虽未更新小羊驼,却发布开源3D模型SAM 3D。它能精确重建人或物体3D模型,有真实三维感知,有两模型,性能强,应用场景多。
边打字边出片,交互式生成长视频!英伟达联合MIT开源新SOTA
AI拍长视频不再难!英伟达联合MIT推出LongLive,可实时交互生成流畅画面,解决传统方法卡顿、不连贯等痛点。它能生成15秒到240秒视频,性能达SOTA,还靠三把“钥匙”解决长、顺、快难题。
Hinton预言错了!年薪狂飙52万美元,AI没有「干掉」放射科医生
2016年Hinton预言放射科医生五年内会被AI取代,如今近九年过去,美国放射科医生未被取代,平均年薪达52万美元成全美第二高薪医疗专业,岗位数创新高。AI替代受限,因实际性能、监管、作用范围等问题。