「麦琪的花园」共找到 10677 篇相关文章
一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”
NVIDIA 推出多模态大语言模型 OmniVinci,结合架构创新与数据合成流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发争议。
jiSGLang集成ktransformers:2TB内存运行Kimi K2 Thinking模型
对于内存多但GPU资源有限的用户,SGLang集成ktransformers的CPU内核,支持直接运行Kimi K2 Thinking模型。它无需等量化,还能微调,虽性能与GPU方案有差距,但给用户新选择。
Meta 即将上线全球最大算力集群
小扎在算力投入上毫不手软,Meta 即将上线全球首个 1GW+ 能耗的超级计算机机群,还在新建 Hyperion 算力集群,几年内功耗将达 5GW,远超老马 30 万张卡集群的 200 - 300 兆瓦。
狂揽81.8K star!Google Firebase 免费开源替代,真香啊~
在开发中后端搭建常令人困扰,Supabase作为开源的Firebase替代品出现。它基于一系列开源工具构建,提供完整且易用的后端解决方案,涵盖数据库管理等多项功能,有多种性能特色,还介绍了使用方法和体验,值得开发者尝试。
“毋在浮沙筑高台”:汪源谈智能体想从 80 分跨到 90 分,全卡在上下文
前网易副总裁汪源在2026奇点智能产品大会分享,指出智能体系统瓶颈正从模型能力、Harness工程,转移到上下文。他还介绍了做好上下文基础设施的要点,以及推出的新内容格式KRL。
腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作
大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。
谷歌Chrome觉醒!Gemini 3全面接管,38亿用户一夜进入Agent时代
谷歌官宣所有桌面端Chrome浏览器接入Gemini 3,38亿用户的浏览器进化为全能AGI入口。此次更新改变人机交互方式,Chrome具备多种智能功能,如自动浏览、调用全家桶服务等,开启AI驱动的浏览时代。
实时编辑、实时互动视频双旗舰,Vidu S2发布即体验
本文介绍生数科技推出的Vidu S2,专为实时交互编辑设计的AI视频模型,覆盖三类核心能力,公开技术路线,发布当天开放体验与API,迭代仅用69天。
旧金山大停电,Waymo自动驾驶汽车瘫痪,特斯拉赢麻了
上周六旧金山大规模停电,由PG&E变电站火灾引发,约12万用户受影响。Waymo自动驾驶汽车因信号灯熄灭大规模瘫痪,造成交通堵塞。而特斯拉开启FSD的汽车正常行驶,凸显不同技术路线优劣。
RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异
清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。