「GPU实现」共找到 2446 篇相关文章
何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升
何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。
谢赛宁等推出统一多模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源
谢赛宁等团队推出统一多模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比多种设计方案,确定CLIP + Flow Matching最佳,模型在多任务测试表现卓越且全开源。
刚刚!OpenAI正式官宣调整公司结构:奥特曼发全员信承认AGI会由多家公司实现
OpenAI宣布调整公司结构,非营利组织继续控制,盈利实体转型公益企业(PBC),采用常规股权结构,非营利组织成PBC大股东。Sam Altman称这非出售,是结构简化调整,目标是让AGI惠及全人类。
英伟达放弃GPU上LPU:新推理芯片被曝Groq即买即用,OpenAI第一个吃螃蟹
英伟达将在GTC大会发布新AI推理系统,核心芯片基于Groq的LPU架构,首位大客户是OpenAI。选择外部架构与时间窗口有关,推理场景中LPU更适配。同时,英伟达推理芯片面临诸多威胁。
AI for Science开年新突破:中科大实现多尺度结构逆向设计128倍加速,登上Nature子刊
中国科学技术大学联合多所院校,在多功能双连通多尺度结构逆向设计领域取得突破,成果发表于Nature Communications。研究解决核心瓶颈,提供新范式,在多方面展现优势与潜力。
论文深度解读:大模型(LLM)加持下的自主无人机分层智能体框架,实现自主规划
文章解读《A Hierarchical Agentic Framework for Autonomous Drone-Based Visual Inspection》论文,介绍分层智能体框架让无人机群自主规划。研究对比三种‘思考模式’与不同‘大脑’组合,还指出未来研究可开发混合系统、混合能力智能体及自适应系统。
快手解密「AI印钞机」,首提生成式强化学习出价技术,为平台实现超过3%的广告收入提升
文章介绍快手首提生成式强化学习出价技术,为平台提升超3%广告收入。还阐述广告自动出价挑战及业界方案,介绍快手GAVE和CBD算法破解难题,其团队成果丰硕,未来技术有两大演进方向。
攻克大模型「表格盲区」!ST-Raptor框架发布,实现复杂半结构化表格的精准理解与信息抽取
半结构化表格布局多样、结构复杂,让自动化数据处理困难。上海交大等团队发布 ST - Raptor 框架,提出 HO - Tree 数据结构及树上操作,构建 SSTQA 数据集,提升表格问答准确率,弥补大模型处理短板。
告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!
北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。
AI 设计9个月就能媲美Blackwell?OpenAI “辣芯”绕开英伟达正面战场,但老黄的GPU大盘不稳了
OpenAI 展示与博通联合打造的定制 AI 芯片 Jalapeño,性能媲美英伟达 Blackwell 或谷歌 TPU。计划年底部署,是多代芯片开发首步。它专为大模型推理设计,设计周期短,成本低,OpenAI 借此扩展全栈能力。