「边缘云计算」共找到 1123 篇相关文章
跳过88%专家,保住97%性能!MoE推理的正确玩法| CVPR’26
多模态大模型走向大规模,MoE架构虽降低计算开销,但推理成本仍高。香港科技大学等团队提出MoDES,它是training - free动态专家跳过框架,能跳过88%专家还保留97%性能,推理速度提升2倍。
Qwen 团队动荡:三个核心成员同时离职
2026年3月3日半夜,通义千问(Qwen)团队核心技术负责人林俊旸公开告别,至少两位核心贡献者也相继离场。猜测离职或因阿里云架构调整、DAU考核压力。此变动对开源生态中期影响大。
清华联手千问重塑归一化范式,让 Transformer 回归「深度」学习
Pre - Norm和Post - Norm是Transformer架构中稳定信号流的关键范式,但面临权衡取舍。近日,清华黄高团队联合千问团队提出SiameseNorm,构建参数共享的平行通路,实现稳定训练并提升性能。
治好多模态近视和走神!上海大学去偏干预显著提升模型性能
多模态大模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海大学与南开大学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。
陈天桥邓亚峰联手破解大模型记忆难题!4个月打造SOTA系统,悬赏8万美元发起全球记忆挑战赛
今年全球AI圈聚焦大模型记忆技术。陈天桥和邓亚峰带队的EverMind推出世界级长期记忆系统EverMemOS,发布即SOTA。其模拟人脑记忆机制,开源且上线云服务,还发起8万美元记忆起源大赛。
前OpenAI科学家&GPT之父:预训练精准数据过滤,极低成本削弱大模型危险能力数千倍
Claude价值观塑造者Neil Rathi和GPT之父Alec Radford发论文,提出预训练时精准“删掉”危险知识碎片,以极低计算成本将大模型特定危险能力削弱数千倍,且不损通用智能。
效率狂飙数倍后:Coding Agent已然成熟,但开放世界仍是“无人区”
2025 年被定义为 Agent 的‘工程落地元年’。MCP、A2A 协议及多智能体协同框架推动 Agent 应用爆发,但企业级落地仍面临多 Agent 协作低效等挑战。AI Coding 和自动化运维是落地较成熟领域,其终极形态观点不一。
「OS产业报告」解读:国产操作系统的技术突围与生态跃迁之路
2025 龙蜥操作系统大会发布《国产服务器操作系统发展报告(2025)》,预测未来三年国产 OS 国产化率将升至 65%、市场规模破 300 亿元。「AI 进化论」第七期邀请专家解读报告,探讨国产 OS 的发展逻辑、技术突破与生态建设。
Light-X来了!全球首个「镜头×光照」双控4D视频生成框架,单目视频秒变电影级
新加坡南洋理工大学等科研机构联合推出Light - X,全球首个「镜头×光照」双控4D视频生成框架。它解耦相机与光照,在扩散模型中融合,还构建Light - Syn数据管线,实验显示其效果显著优于现有方法。
全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案
随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。