「推理大模型」共找到 9678 篇相关文章

算法论文8

谷歌分布式训练开启另一轮扩展定律!百万芯片高压高故障仍然零全局停机

谷歌Decoupled DiLoCo研究打破大模型训练锁步模式,让集群各部分异步汇合。模拟数百万芯片高压训练时零全局停机、性能无损,还能提升系统有效工作时间,有算力撷取和异构计算等红利。

AIGC开放社区
新闻资讯8

全球自动驾驶激战,滴滴与清华走出一条技术新路

2026年全球自动驾驶竞赛白热化,Waymo高歌猛进,特斯拉遇困境。滴滴与清华合作,成立实验室,发布STAPO算法,打通产学研链路。滴滴自动驾驶低调务实,掌握全栈技术,将出海阿联酋,其主业优势保障稳健发展。

新智元
Product Application7

补上OpenClaw最大短板!中国AI独角兽亮出龙虾盒子,打工人放心养虾

OpenClaw热潮下,云端隐私数据保护缺位,端侧算力和全模态脱敏能力不足制约其落地。无问芯穹推出InfiniClaw Box,具备多信源融合等能力,采用端云一体架构,实现隐私安全与大模型能力融合。

新智元
推荐文章7

鹅厂员工那些“需求很大,却没人做”的小程序?

鹅厂员工分享了多个需求大却没人做的小程序idea,如“鹅众点评”、展示商场餐厅实时人流量的小程序、老年人“极简版”工具小程序等,涵盖生活、出行、旅游、育儿等多方面。

腾讯技术工程
7

超760万元奖金悬赏,谁能徒手重构 DeepSeek 与 Kimi 的性能底层?

在大模型工程化需求下,AMD 联手 GPU MODE 发起 2026 线上黑客松:AMD E2E Model Speedrun 全球挑战赛,豪掷 110 万美元。大赛分预选赛和决赛,各设丰厚奖励,目前预选赛已进入倒计时。

AI科技大本营
产品应用7

3D-AIGC 存储架构演进:从 NFS、Gluster 到 JuiceFS

光影焕像在 3D-AIGC 存储上,因三维模型数据量大、格式多,对存储要求高。经探索,从 NFS、GlusterFS 到最终选 JuiceFS,搭建统一存储平台,管理上亿文件,提升处理速度,简化运维。

InfoQ
推荐文章8

LightX2V fp4 quant kernel代码笔记

这是关于 LightX2V 里 `lightx2v_kernel` 做 FP4 量化 GEMM 的读码笔记,解释接口和约束、kernel 关键路径等问题,还介绍 NVFP4 和 MX-Formats 量化原理、代码实现,以及 LightX2V 项目中的实际使用。

GiantPandaLLM
产品应用7

刚刚,OpenAI推出全新ChatGPT Images,奥特曼亮出腹肌搞宣传

OpenAI推出全新ChatGPT Images,由新旗舰图像生成模型驱动,特性有精准编辑、保留细节等,图像生成速度提升4倍。该功能今日向多数用户开放,价格降20%,旨在让图像生成更简单。

机器之心
开源动态8

给Agent装上“海马体”!上海AILab开源MemVerse,定义多模态记忆新范式

上海人工智能实验室开源MemVerse,这是首个面向智能体的通用多模态记忆框架。它将多模态信息与文本对齐到统一语义空间,首创‘双通路’架构与‘记忆蒸馏’技术,让智能体有终身记忆能力,在多模态任务中表现出色。

量子位
算法论文8

AAAI 2026 | 革新电影配音工业流程:AI首次学会「导演-演员」配音协作模式

现有AI配音缺“人情味”,因跳过“导戏”“揣摩”环节。内蒙古大学刘瑞教授团队在AAAI 2026提出Authentic - Dubber框架,模拟真实配音流程,实验显示其情感表达优势明显,提升了AI配音竞争维度。

机器之心