分布感知损失」共找到 467 篇相关文章

算法论文7

清华-腾讯联手:音频 - 视觉多模态任务统一框架

Crab是人大、清华和腾讯合作论文提出的模型,目标是高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。

CourseAI
算法论文7

李飞飞团队新作:DiT不训练直接改架构,模型深度减半,质量还提高了

本文介绍「嫁接」技术,可在小计算预算下编辑预训练 DiTs 探索新架构。不从头训练,替换算子创建混合架构,保持质量同时减少计算量。还通过实验展示该技术在构建高效架构和文生图模型中的效果。

机器之心
新闻资讯7

黄仁勋放话:中国AI市场3年内达500亿美元!AI救了旧金山,整个世界急于与AI互动

黄仁勋最新判断,未来两到三年中国AI市场可达约500亿美元,错过是巨大损失。他还提到AI让旧金山复苏,虽会使部分人失业,但也创造新岗位。此外,英伟达财报值得期待,老黄获十年来首次加薪。

量子位
开源动态8

打破碎片化瓶颈!浙大&哈佛开源UniGeo,高保真相机可控编辑

当前主流相机可控图像编辑基于图像扩散模型,应对连续相机运动易出现问题。近日,浙大联合哈佛发布UniGeo框架,在三核心层面注入统一几何引导,克服结构退化,提升视觉质量与跨视角一致性。

新智元
新闻资讯7

a16z全球AI产品Top100:AI入口之争已经打响,OpenClaw开启通用Agent时代

a16z发布全球AI产品Top100第六版更新,AI成主流默认功能,Gemini追ChatGPT凶猛,通用Agent登场。还介绍了各领域竞争态势、市场地理分布、创意领域演变等情况。

Founder Park
算法论文8

不愧是中国机器人,乒乓打得太6了

清华姚班本科生苏智团队在论文中提出结合模型规划与强化学习的分层框架,让宇树G1机器人实现亚秒级反应下的稳定连续对打,在真实实验中击球和回球率高,还能连打106拍。

量子位
算法论文8

Attention Sink产生的起点?清华&美团首次揭秘MoE LLM中的超级专家机制

清华和美团研究聚焦MoE LLM,首次发现超级专家子集。通过多模型实证分析,揭示其分布规律、重要性及对注意力机制的影响,开发识别工具,为模型压缩提供新方向。

机器之心
算法论文7

多模态模型具备“物理推理能力”了吗?新基准揭示:表现最好的GPT-o4 mini也远不及人类!

来自多机构研究人员构建PhyX基准测试,评估多模态模型物理推理能力。测试显示,即便表现最佳的GPT - o4 mini准确率仅45.8%,远不及人类的75.6%,且模型在多方面存在结构性缺陷。

量子位
产品应用7

OpenAI很看好!首个SWE-1模型发布,软件开发或将提速99%

Windsurf发布首个前沿模型SWE-1,目标将软件开发提速99%。它不只能写代码,还能协助软件工程流程。有三个系列模型,SWE-1运行成本低,SWE-1-lite对所有用户开放,SWE-1-mini适用于低延迟场景。

新智元
推荐文章8

深入原子世界,他在寻找材料失效的原因

文章介绍了美国宾夕法尼亚州立大学副教授杨洋的材料研究。他利用先进电子显微技术,研究材料在极端环境下微观过程,如空位、虫洞腐蚀和短程有序,旨在理解材料失效机制,推动材料设计优化。

DeepTech深科技