「在离线混部」共找到 8196 篇相关文章
浙大提出Translution:统一Self-attention和Convolution,ViT、GPT架构迎来新一轮性能突破
近日,浙大与新加坡国立大学提出新型深度神经网络基础操作Translution,融合Self - Attention与Convolution优势,实现二者统一。基于它构建的网络在ViT和GPT架构下性能提升,但对算力要求更高。
RAG新王:AccurateRAG屠榜SOTA
大模型记不住私有或实时信息,RAG 落地遇难题。AccurateRAG 是 Qualcomm 团队端到端工程方案,有 4 个模块化组件,在 6 个数据集上刷新 SOTA,解决 RAG 文档解析、检索和生成难题。
ImageNet分数越高,生成反而越糊?iREPA给出解释
Adobe Research论文指出,视觉模型在ImageNet分类准确率高,生成效果未必好,全局语义强易压扁空间结构。iREPA修改REPA训练流程,削弱全局干扰,提升了生成质量。
ICME专题征稿 | 具身多模态智能:从感知到世界建模
ICME是多媒体领域国际顶级会议,2026年将在泰国曼谷举行。此次专题征稿聚焦具身多模态智能,涵盖多模态感知、世界模型等主题,介绍了投稿详情及联系方式。
微信可以用“龙虾”了!(附教程)
腾讯22日发布消息,微信正式推出“ClawBot”插件,支持接入OpenClaw。用户扫码或复制命令接入后,能在微信聊天中快速调用“龙虾”,用于学习、工作、创作等场景。
CNCF 警告:仅靠 Kubernetes 不足以保障 LLM 工作负载的安全性
云原生计算基金会(CNCF)指出,企业在 Kubernetes 上部署大语言模型(LLM)存在安全缺口。Kubernetes 无法理解或控制 AI 系统行为,需增加额外控制层,引入 AI 特定控制。
AI已参与战争:硅谷巨头Anthropic与五角大楼的首次交锋始末
硅谷明星Anthropic因追问Claude在美军行动中的使用方式与五角大楼决裂。五角大楼推行新条款,Anthropic拒绝,被封杀。此争端引发科技界阵营分裂,OpenAI后续达成协议但遭质疑。
突发!Claude 4.5 发布,这次更新不止是模型!
Anthropic发布Claude 4.5,在编程等任务中表现优于GPT - 5。Claude Code升级,API添新功能,模型能力提升,对齐性改善。还推出Claude Agent SDK及“Imagine with Claude”功能。
刚刚,OpenAI苏黎世办公室被Meta一锅端,三名ViT作者被挖走
华尔街日报报道,Meta CEO 马克・扎克伯格挖走 OpenAI 苏黎世办公室的三位研究者 Lucas Beyer、Alexander Kolesnikov 和 Xiaohua Zhai。扎克伯格为夺回 AI 优势大力招人,开价诱人,OpenAI 也在反制。
grok 4一图流
文章展示grok 4核心数据,涵盖训练成本、模型定价,还列举其在通用、专业、数学、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。