多GPU性能」共找到 5701 篇相关文章

算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在场景实验中表现出色,不过有实验边界。

量子位
开源动态8

刚开源就斩获 3.8K Star!MiniMax 官方把压箱底的硬核技能包开源了!

MiniMax 官方开源 Skills 仓库,这是一套为 AI 编码助手设计的开发技能包。涵盖前端、全栈、Android、iOS、图形开发及办公等领域,按流程走可让 AI 代码质量对标大厂资深工程师,安装也简单。

开源星探
开源动态8

阿里开源 Qwen3-TTS 全家桶!语音设计、克隆、生成全打包,开源 2 天 3K Star!

阿里通义团队开源 Qwen3 - TTS 全家桶,含语音设计、克隆、生成功能,开源 2 天获 3K + Star。它有秒级克隆、语音设计等能力,有 0.6B 和 1.7B 两种规格,双轨架构等技术创新保障性能

开源星探
推荐文章7

SpaceX:天基基础设施垄断者

传言SpaceX明年将IPO,作者认为其正把‘先发优势’转为‘物理垄断’,将成‘人类未来天基基础设施的唯一垄断者’。它有极强运力成本优势,能抢占轨道和频谱资源,变现方式或为把GPU发上天。

newtype AI
开源动态8

Mistral 3开源,一举超越DeepSeek与K2?

近期,Mistral AI开源Mistral 3,含三款小型稠密模型及Mistral Large 3。Benchmark对比中,它领先国内DeepSeek - 3.1、Kimi - K2。Mistral Large 3是强开源权重模型,Ministral 3适合边缘端,成本性能比低。

PaperAgent
开源动态8

ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节

格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在任务验证中表现优异。

机器之心
产品应用8

美团提出首个语音交互GUI智能体,端到端语音训练能力优于传统文本训练

美团和浙大联合推出GUIRoboTron - Speech,这是首个能利用语音指令和屏幕截图端到端决策的自主GUI智能体。它解决了文本依赖问题,团队经步骤研发,其性能评估表现佳,还给出招聘信息。

量子位
推荐文章7

“由 AI 生成的代码,从诞生那一刻起就是「遗留代码」!”

如今生成式AI融入软件开发,AI生成的代码一诞生或被视为“遗留代码”。它缺乏上下文记忆和维护连续性,虽有开发者尝试弥补,但代码未来或靠提示生成。文章观点在Hacker News引发讨论。

AI科技大本营
新闻资讯7

SpAItial发布超逼真3D空间基础模型

德国AI初创平台SpAItial获1300万美元种子轮融资,发布超逼真3D基础模型。其核心技术能理解3D世界,可基于文本或图片生成3D场景,在领域有革新可能,虽有竞争,但未来有望推动AI三维突破。

AIGC开放社区
新闻资讯8

刚刚,谷歌Gemini 3.8登场!姚顺宇:RSI巨大飞跃

深夜谷歌推出Gemini 3.8,六周内第三款Flash系列模型。含通用的Gemini 3.8 Flash和网络安全专用的Gemini 3.8 Flash Cyber,提升推理、代码能力,在场景表现出色。已面向不同群体开放。

机器之心