「指令集架构」共找到 2565 篇相关文章
推理成本太高、算力不够用?单纯堆卡没用,得靠极致的“压缩”与“调度” | AICon
大模型落地面临推理成本高、算力需求大的问题。AICon大会上,阿里云刘峥、ModelTC龚睿昊、阿里巴巴马腾、OPPO宋晓辉、清程极智汤雄超等专家将分享从压缩到调度的推理优化方案,覆盖云到边缘、多算力平台。
PPIO姚欣:AI正在进入自主行动与创造时代,智能体需要全新的操作系统|MEET2026
在量子位MEET2026智能未来大会上,PPIO姚欣表示AI进入自主行动与创造时代,Agent会成未来AI主力,Agent Infra将成新操作系统。PPIO构建AI云能力,还推出Agent沙箱助力厂商落地。
对话鹿明CTO丁琰:数据会反向决定模型,甚至影响硬件形态 | GAIR 2025
本文是对鹿明CTO丁琰的访谈。丁琰博士最早将UMI落地实践,其数采方案「FastUMI」受青睐。他认为UMI是完整体系,数据会反向影响多方面。还对比多种数采方式,介绍FastUMI改进及Pro版优势。
Transformers来到了v5时代:从工具包到真理之源,AI时代的操作系统内核的极简进化论
Transformers v5发布,通过极简定义和极致互通成AI生态核心。它做减法重构代码、拓展训练流程、成推理引擎弹药库、提升量化为核心功能,连接训练、推理与部署,是AI生态通用语言。
这款拿下 10k+ Star 的开源 LLM DevOps 平台,如何帮企业“批量孵化”AI 应用?——BISHENG 深度上手
BISHENG 是面向企业级场景的开源 LLM 应用 DevOps 平台,支持 GenAI 工作流等完整能力,已在众多头部组织落地。它围绕企业痛点搭建,有灵思 Agent、可视化工作流编排等亮点,适用于多场景。
超越 VTM-RA!快手双向智能视频编码器BRHVC亮相NeurIPS2025
视频编码中双向编码潜力待挖掘,快手音视频技术团队提出BRHVC方法,解决长跨度帧运动处理和参考贡献不平衡问题,其成果被NeurIPS 2025录用,在压缩性能上超越VTM - RA编码。
MeshCoder:以大语言模型驱动,从点云到可编辑结构化物体代码的革新
生成式AI在三维空间面临挑战,传统3D生成成果粗糙难编辑。团队推出MeshCoder,将三维输入翻译成结构化代码,有分部件生成等优势。介绍其实现路径、实验性能,也指出局限并展望未来。
谷歌Nano Banana 2 来了,图片AGI提前到来?
伴随Gemini 3、GPT 5.1小道消息,谷歌Nano Banana 2提前到来。它采用多步骤生成流程,有自我纠错循环,能替代部分Photoshop功能,在细节、配色等方面比一代提升明显,即将正式上线。
2025谷歌博士生奖学金揭晓,清华、科大、南大等校友入选
本周四,谷歌公布2025年度博士奖学金入围名单,获奖者来自35个国家和地区、12个研究领域,共255名博士生。文章介绍了各领域的华人研究者情况,涉及算法、架构、人机交互等多个方向。
AI打通第一/第三人称视觉,跨视角视觉理解新SOTA|ICCV 2025 Highlight
INSAIT、复旦大学等联合提出ObjectRelator框架,让AI精准匹配不同视角下同一物体,实现跨视角统一表征与理解。它在Ego转Exo和Exo转Ego任务上超基线模型,已被ICCV 2025接收,代码开源。