「Kimi K2.5模型」共找到 9143 篇相关文章
千问3:开源第一不只是说说!
英伟达新开源的OpenCodeReasoning系列选千问作基础底座。千问3以Apache 2.0发布后,开发者生态更新频繁,衍生模型超10万,下载量破3亿,全球第一。其性能强,正加速开启全栈式AI时代。
震撼实锤!清华姚班校友揭「1.4×加速」陷阱:AI优化器为何名不符实?
为降低大模型预训练成本,近年新优化器频出,宣称加速1.4×到2×却难落地。斯坦福研究指出方法学缺陷,对比不同缩放范式加速差异,给出优化器设计见解,证实严格基准评测必要。
16个月后Meta杀回开源,小扎力挺蒸馏
Meta发布新开放AI模型Muse Glimmer底层参数,未来几周将开放Muse Spark 1.2模型权重。扎克伯格力挺开源,称要为数十亿人提供免费强大AI,还为模型蒸馏辩护。Meta此举有现实压力,也想创造算力需求。
中兴星云拿下推理总分榜一!SuperCLUE 5月成绩出炉
2025年全球AI大模型竞赛激烈,SuperCLUE发布5月报告,中兴通讯星云大模型Nebula Coder - V6推理专项榜单总分并列第一、总榜并列第二,细分赛道表现佳,且是少数获国家级权威安全认证的大模型。
720美元套出A社死藏的Opus原始思维链,还是Haiku泄露的,GPT/Gemini也中招
研究人员发现,将大模型返回的加密推理块扔给同厂小模型让其复述,就能破解大模型隐藏的思维链。如Anthropic、OpenAI、Google的模型均中招,还会带来隐私、安全等风险,虽已打补丁,但仍有难题。
GPT-4o,确认死亡
太平洋时间13号早上10点,OpenAI正式下架GPT-4o等旧模型。GPT-4o因吉卜力风爆火,也因“谄媚”饱受争议。网友不满,呼吁回归,因其新模型太“人机”。模型与用户建情感连接是双刃剑,AI安全与伦理成议题。
Unsloth发布Qwen3-VL本地运行和微调指南,修复隐藏bug
Unsloth团队修复Qwen3-VL系列模型聊天模板语法问题,重新上传GGUF量化文件,使模型可本地稳定运行。介绍了不同规格模型硬件需求、表现,给出部署步骤、参数差异,还展示多模态能力测试,提供多种格式模型及微调工具。
面向 SGLang 的 Profile Analysis SKILL:3 张表定位 Kernel Fuse 和 Overlap 机会
文章介绍了面向SGLang的Profile Analysis SKILL,其工作流统一,输出3张表定位Kernel Fuse和Overlap机会,支持多种分析方式和模型。还给出Qwen/Qwen3.5 - 4B和openai/gpt - oss - 20b的分析结果,并表明该SKILL能节省token、缩短工期,作者厌恶Torch Compile。
3D-R1重塑三维视觉语言推理!让三维交互更智能
近年来,视觉 - 语言模型在2D图像理解有突破,但3D视觉语言模型面对复杂场景不足。为此上海大学团队提出3D - R1模型,它基于新数据集和策略构建,有强多任务三维理解能力,不过也存在进步空间。
直播实时离线翻译
传统离线翻译模型有延迟问题,GitHub上NoLanguageLeftWaiting开源项目把Meta的NLLB模型改造成实时同传模型,能边听边译,支持200种语言互译,还在开发推测解码功能提升速度。