「高性能计算芯片」共找到 2900 篇相关文章
谢赛宁等推出统一多模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源
谢赛宁等团队推出统一多模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比多种设计方案,确定CLIP + Flow Matching最佳,模型在多任务测试表现卓越且全开源。
Borg调度进化了!谷歌超强AI Agent 登场:能设计算法、提效系统,陶哲轩亲自助攻,网友封神理科扛把子!
谷歌 DeepMind 推出由 Gemini 驱动的 AI 智能体 AlphaEvolve,能设计算法、提效系统,破多项数学记录。它已用于谷歌多领域,还将探索材料、药物研发等领域,也计划推早期访问计划。
老黄公开叫阵谷歌,一个能打的都没有!首次承认低估了Anthropic
在近两小时播客中,英伟达CEO黄仁勋与主持人深度对话,重申技术护城河,对全球竞争格局表达预判。他叫阵谷歌TPU、亚马逊Trainium上MLPerf打擂,无人应战;还承认低估Anthropic,阐述英伟达商业哲学。
几千亿美元远远不够!黄仁勋亲笔长文:AI 是人类历史上最大的基建浪潮
英伟达CEO黄仁勋发布长文,指出AI是关键基础设施,运行依托硬件、能源与经济规律。AI可解构为五层架构,目前投入仅数千亿美元,未来还有数万亿规模待建,正演变成最大基建运动。
腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式
过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。
已证实!清华姚班陈立杰全职加入OpenAI,保留伯克利教职
据机器之心求证,清华「姚班」校友、伯克利助理教授陈立杰已全职加入 OpenAI 开展研究,同时保留伯克利教职。他是理论计算机科学顶尖青年学者,学术成就卓越。
QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5
通义文档智能团队推出QwenLong - L1.5长文本推理专家,提供端到端长文本推理后训练“配方”,含数据合成管线、强化学习方法、智能体架构,在多基准测试成绩佳,代码已开源。
HF Papers直播 AI Insight Talk | OCR 专场
由Hugging Face等联合发起的【AI Insight Talk】系列直播活动第6场 - OCR专场明天开启。将剖析三项技术方案,举办圆桌对谈。还会有嘉宾介绍HunyuanOCR、PaddleOCR - VL、MinerU等模型的技术亮点。
Qwen开源版Banana来了!原生支持ControlNet
Qwen推出新图像编辑模型Qwen - Image - Edit - 2509,支持多图融合、增强单图一致性,原生支持ControlNet。还开源端到端全模态模型Qwen3 - omni,性能优异,功能丰富。
Kubernetes环境中作业帮大模型服务流量调度优化实践
随着大语言模型应用渐广,Kubernetes 现有 Ingress 组件在大模型服务流量管理上有局限。作业帮提出创新调度方案,整合成模型网关,具备五项核心功能,提升了资源效率、稳定性和易用性。