「推理性能优化」共找到 4212 篇相关文章
阿里开源 Qwen3-TTS 全家桶!语音设计、克隆、生成全打包,开源 2 天 3K Star!
阿里通义团队开源 Qwen3 - TTS 全家桶,含语音设计、克隆、生成功能,开源 2 天获 3K + Star。它有秒级克隆、语音设计等能力,有 0.6B 和 1.7B 两种规格,双轨架构等技术创新保障性能。
摩尔线程AIBOOK一周实测:开箱即训的「AI Native」体验
摩尔线程AI算力本MTT AIBOOK专为AI学习与开发者打造。它搭载「长江」芯片,提供50TOPS异构AI算力,运行MT AIOS系统,预置完整AI开发环境。实测显示其部署简单,性能出色,还具备端云一体等优势。
老黄挤爆牙膏!DLSS 4.5狂飙6倍,RTX 50系直接封神
2026年CES大会上,英伟达发布DLSS 4.5提升画质与帧生成,RTX Remix助力经典游戏重生,还将NPC变智能伙伴。同时,其软件升级利好AI PC,提升性能、减少显存消耗,让它更接近日常使用。
Claude Code 2.1 发布:一口气更新了80多个功能特性
2026年1月7日Claude Code发布2.1.0版本,后又跟了2.1.1小修复,更新内容超80条。有Skills自动热重载等新功能、大量bug修复及体验优化。作者建议大家升级,认为它想做完整开发环境。
Groq被收购,失去梦想的员工,人均拿到英伟达的500万美元
2025年末,英伟达以200亿美元对价、“资产收购 + 人才招募”方式将AI推理芯片对手Groq收入麾下,避免反垄断。交易溢价近3倍,款项分阶段支付,员工获丰厚补偿,此模式成硅谷AI生态“新常态”。
智能体的记忆管理机制及其潜在风险 | 直播预约
大语言模型(LLM)智能体兴起,记忆机制是核心。本次报告将探讨记忆管理对其性能的影响及潜在风险,展示缓解关键挑战的策略,介绍新攻击范式,揭示安全漏洞,强调需重新审视与建模。
倒反天罡!Gemini Flash表现超越Pro,“帕累托前沿已经反转了”
Gemini 3 Flash在SWE - Bench Verified测试中分数超Pro,速度和性价比也更优。谷歌解释是因Flash有未用于Pro的优化技术。开发者认为应停止‘旗舰版迷信’,强化学习让小模型也能实现‘降维打击’。
罗福莉执掌小米大模型首秀!定调下一代模型,全新MiMo-V2开源还横扫Agent第一梯队
在2025小米人车家全生态合作伙伴大会上,罗福莉首秀解读全新大模型MiMo - V2 - Flash,该模型已开源,采用MoE架构和MTP技术,在多方面表现出色,罗福莉还阐述其设计逻辑与对下一代智能体的看法。
英伟达周末双炸!CUDA二十年最大更新,顺手屠榜AGI比赛
本周末英伟达有两大动作。一是推出CUDA 13.1,这是CUDA平台诞生二十年来最大更新,引入CUDA Tile编程模型等。二是在Kaggle ARC Prize 2025竞赛中,团队用4B小模型变体夺冠,靠合成数据等策略。
大模型被确诊「视觉文盲」!多校联合提出MILO,为它植入空间想象力
空间推理是多模态大语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。多校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五大任务验证其有效。