超节点架构」共找到 3770 篇相关文章

开源动态8

清华系团队出手!一张 4090 即可「爆改」,1.3B小钢炮震撼开源

5月11日,清华系团队面壁智能联合多方开源端侧多模态大模型MiniCPM-V 4.6。它参数仅1.3B,性能阿里、谷歌等同级对手,效率翻倍,还实现两项架构创新,适配主流开源生态,降低开发门槛。

新智元
开源动态8

Kimi K2 Thinking,最强思考模型,附实测

Moonshot AI发布Kimi K2 Thinking模型,它能边思考边行动,是目前最强开源思考模型,多项指标GPT - 5等闭源巨头。其具独特架构,有性能优势,还给出部署方式,实测表现佳。

AGI Hunt
开源动态8

Valkey 9.0 引入多数据库集群、原子级槽位迁移,并带来大幅性能提升

Linux 基金会宣布开源内存存储方案 Valkey 9.0 正式发布。它有原子级槽位迁移、哈希字段过期等新特性,支持编号数据库集群,可扩展到 2000 节点,每秒处理 10 亿次请求,性能大幅提升。

InfoQ
开源动态8

过GPT-image-1!大黑马Black Forest刚开源新模型,只用文本实现一键PS

今日凌晨,Black Forest开源文生图模型FLUX.1-Kontext开发者版本,功能类似PS,用自然语言就能一键P图。测试显示它GPT-image-1,成最强开源文生图模型之一,还在架构、训练、工程层面做了优化。

AIGC开放社区
新闻资讯7

谷歌黑魔法,没人能看懂的Gemini 3 Flash

Gemini 3 Flash速度快3倍且智力Pro,但没人明白其更「聪明」的原因。它打破「参数即正义」逻辑,在多项测试领先。谷歌或靠TPU、算法、数据优化,还可能用了Titans架构,有重大战略意义。

新智元
算法论文8

X-SAM:从「分割一切」到「任意分割」:统一图像分割多模态大模型,在20+个图像分割数据集上均达SoTA

中山大学、鹏城实验室、美团联合提出X - SAM,统一图像分割多模态大模型。它将分割范式扩展,设计通用输入输出,采用端到端架构和三阶段训练策略,在20个数据集达最优,为图像分割研究开辟新方向。

机器之心
开源动态8

阿里达摩院开源具身大脑基模:3B激活参数性能越72B,转身就忘事的机器人有救了

阿里达摩院开源RynnBrain具身大脑基础模型,全系列7个。它是业界首个有 时空记忆的模型,在20项具身Benchmark上顶尖模型。具小而美优势,训练用自研架构提效,数据丰富,输入输出灵活。

量子位
算法论文8

极简主义的胜利:清华团队用最简单的强化学习配方刷新1.5B模型纪录

清华、伊利诺伊大学和上海AI实验室团队提出JustRL架构,仅用单阶段训练和固定参数,在1.5B模型上刷新性能纪录,计算量仅为复杂方法50%,挑战了复杂技术堆叠现状。

AIGC开放社区
开源动态8

阿里AI 重磅第4发:电影级MOE 视频模型Wan2.2正式开源!

阿里通义团队开源电影级视频生成模型Wan2.2,将光影、色彩、镜头语言装进模型,支持60多参数自由组合。它是业界首个用MoE架构的视频生成模型,推理省计算资源,性能主流模型,获国外网友盛赞。

AGI Hunt
产品应用8

阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent

8月3日,阿里发布新一代基座大模型Qwen3.8,总参数量2.4万亿,编程和办公能力提升,在权威榜单中表现出色。其API已上线,价格有优势。‘千问办公’公测,Qwen3.8性能强大,还适配阿里真武M890节点

InfoQ