模型性能提升」共找到 9361 篇相关文章

算法论文8

「重要性采样」并不「重要」?快手清华ASPO攻克重要性采样权重错配

快手与清华合作团队发现大语言模型结果监督强化学习中,重要性采样机制“失灵”,存在权重错配现象。为此提出算法ASPO,在多基准测试中展现优势,训练更稳定。

量子位
新闻资讯7

Fable 5回归全网抓紧测!发现GLM-5.2更香了,价格只有1/39

Claude Fable 5消失19天后全球再上线,7月1 - 7日Pro等订阅用户可用,但额度受限。它实力强但贵,与多模型对比表现优,远程工作能力突出。不过使用限制变多,安全分类器易误伤。

量子位
产品应用7

Legora、Mercor 都在用,Reducto 能成为独立的 LLM 数据入口吗?

当前企业AI落地瓶颈在数据质量,Reducto聚焦数据准确性,以文档解析API提供Agentic OCR能力。它获多轮融资,估值达6亿美元,但面临多模态模型竞争及定价等问题,其未来走向待察。

海外独角兽
产品应用8

Claude Code迎来大更新:Agent能力增强

Claude Code 2.1.0正式发布,围绕Agent能力、开发者体验和安全性全面升级。有大量功能新增,如技能与Agent的热重载、上下文分叉等;修复诸多问题,还进行了性能、可靠性等方面的优化。

AI寒武纪
算法论文7

SMO | 西工大宁晨伽、张伟伟等:基于共享并行神经网络架构的多精度气动融合方法

高可靠性气动数据降本增效是关键命题。本研究总结主流多精度建模方法,提出基于共享并行架构的融合策略,区分公共与私有特征,提升融合框架表征能力,还通过算例验证方法有效性。

力学与人工智能
算法论文8

SIGCOMM 2026 | 从「人眼看视频」到「AI理解视频」:北大提出面向AI的实时通信框架Artic

AI 正从「文字聊天」走向「边看边聊」,传统实时视频通信难以满足需求。北大团队提出 Artic 框架,重构码率自适应等,实验显示其能显著提升准确率、降低延迟。

机器之心
产品应用8

谷歌Alpha家族再登Nature封面!刷新基因组预测SOTA,精准定位远端致病突变

谷歌Alpha家族新成员AlphaGenome登Nature封面,将AI预测拓展到人类基因组图谱。它能综合预测11种基因调控过程,精准定位远端致病突变,性能超现有程序,已面向非商业研究开放API。

量子位
开源动态8

The Batch: 855 | 为智能体而生

总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。

DeeplearningAI
开源动态7

Qwen-Image-Edit 更新:多图编辑支持,单图一致性增强

阿里8月发布的Qwen-Image-Edit迎来月迭代版本Qwen-Image-Edit-2509,可在https://chat.qwen.ai/使用。更新支持多图编辑,有多种玩法,还提升单图一致性,在人物、商品、文字编辑上表现显著。

AI进修生
开源动态7

美团开源Agentic新王,速度拉满,工具调用打爆Kimi?

周末美团开源LongCat - Flash大模型,参数量560B,推理速度达100 token/s,成本低,在Agent工具调用表现超Kimi - K2。它有Zero - Computation Experts和ScMoE创新,不过市场表现未获太多认可。

探索AGI