新能安」共找到 7818 篇相关文章

算法论文8

UIUC提出隐式监督范式:无需标注/RM即可全面提升多模态Reasoning的感知

大型多模态模型在复杂多模态推理中面临挑战,67%错误源于视觉感知缺陷。为此,UIUC提出PAPO,通过隐式感知损失提升模型感知力,无需额外标注,在多模态基准上表现优异,还解决了KL黑客问题。

深度学习自然语言处理
开源动态8

谷歌开源Gemma 3n:2G内存就跑,100亿参数内最强多模态模型

本周五凌晨,谷歌正式发布、开源全端侧多模态大模型 Gemma 3n。它有多模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在多方面实现质量提升。

机器之心
产品应用8

这个AI救命!提前6个月发现胃癌病灶,突破医学影像认知,达摩院做成了

国内成果登《自然·医学》,全球首个用平扫CT识别早期胃癌的AI模型DAMO GRAPE诞生。它突破传统影像限制,提升胃癌检出率。此前达摩院还研发出筛查胰腺癌的DAMO PANDA,未来探索‘一扫多查’。

量子位
算法论文7

美7000万人或被取代,Agent光速卷入职场!北大校友、杨笛一

斯坦福大学研究团队调查104个职业领域1500名专家及52名AI研究员,构建WORKBank数据库。研究发现职场AI需求与力错配,工人对AI态度不一,还揭示未来人类技变化趋势。

新智元
新闻资讯7

小扎豪掷143亿美元赌「王」!28岁华人亿万富翁入职Meta,与谷歌决裂

Meta豪赌143亿美元,扎克伯格押注28岁天才Alexandr Wang掌舵超级智项目。Alexandr宣布离任Scale,谷歌强烈反对并终止合作,此举或引发AI行业大地震。

新智元
算法论文8

单卡4090也高质量视频编辑!西湖AGI Lab无训练框架FlowDirector来了

视频编辑门槛高、现有方法开销大且效果不佳。西湖大学AGI Lab团队提出无需训练的FlowDirector框架,可将基于流的视频生成模型改造成编辑工具,质量高、功广、开销低,解决了时序、结构和编辑幅度问题。

机器之心
新闻资讯8

华为创造AI算力纪录:万卡集群训练98%可用度,秒级恢复、分钟诊断

大模型落地需强大算力集群支撑,构建万卡级算力集群是顶尖挑战。华为昇腾万卡算力集群近乎‘永不罢工’,其公开技术秘密,提出‘3+3’双维度技术体系,多项指标表现优异。

量子位
开源动态8

突破传统检索瓶颈!阿里通义实验室发布 WebDancer,开启多步推理智范式!

在信息爆炸时代,传统检索技术缺乏动态决策力,难以满足多步推理需求。阿里通义实验室发布的 WebDancer 基于 ReAct 框架,通过四阶段构建,在测试中表现优异,未来规划拓展工具生态、突破任务边界等。

开源星探
新闻资讯7

大模型的战场在推理?——《推理模型综合测评报告 2025》深度解析 | 直播预告

5月29日,InfoQ研究中心发布《推理模型综合测评报告2025》,通过五大维度、五大题型的300道测试题对八家主流推理模型全面测评,还总结各维度表现,梳理技术前置因素与趋势。6月6日有直播解读。

InfoQ
推荐文章7

中学生就看懂:从零开始理解LLM内部原理【九】| 层归一化:神经网络的稳定器

本文是系列文章第九篇,介绍了神经网络中的层归一化。先回顾标准差、标准分概念,指出其可使差异可控稳定。接着说明层归一化将原思想用在神经网络,还加入可学习参数,最后总结其作用与应用位置。

AI大模型应用实践