新能安」共找到 7785 篇相关文章

算法论文8

ICML 2026 | 华为GTS提出AI训练数据方法,Amazon/Google作者团队「光速跟进」:难度自适应训练正在成为范式

华为GTS研发部AI数据团队提出EDCO方法,将样本难度估计与动态课程编排引入领域大模型微调。该方法用推理熵动态编排训练课程,让模型面对最有学习价值的样本,已被ICML 2026接收。

机器之心
产品应用8

阿里Qwen3.5小模型发布:0.8B参数就处理视频,边缘AI时代真的来了

阿里通义千问发布Qwen3.5系列四款小模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。

AI工程化
8

对话百度文库:不做大模型直接做的事,力积累换来竞争壁垒|AI产品Time

百度文库从文档检索平台转型为一站式AI内容获取和创作平台,付费用户超4000万,AI MAU近亿,智PPT访问量全球第一。访谈中,负责人分享产品理念、优势及运营经验,如不走大模型直接做的事,从用户需求出发开发功等。

量子位
开源动态8

不用千亿参数也合成高质量数据!这个开源框架让小模型“组团逆袭”,7B性直追72B

上海人工智实验室与中国人民大学提出GRA框架,以“多人协作”理念让小模型分工生成高质量训练数据。实验显示其生成数据质量高,项目已开源。它打破对大模型蒸馏依赖,展现“集体智”潜力。

量子位
算法论文8

给大模型「持续注入知识」,北航CASE框架:编辑千次不失忆,额外参数不到1MB丨WWW'26

北航团队提出CASE框架解决大语言模型持续吸收知识难题。该框架给编辑“算分”、调“关键神经元”,破解核心痛点。实验显示,1000次编辑后准确率提升近10%,额外参数不到1MB。

量子位
开源动态8

只训练数学,却在物理化学生物战胜o1!强化学习算法带来显著性提升,还缓解训练崩溃问题

上海创智学院、上海AI Lab的MM - Eureka系列工作提出强化学习算法CPGD,缓解训练崩溃问题,提升性。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。

量子位
新闻资讯7

腾讯混元挖走微软明星大模型团队!一作全员出走,成果已跻身大模型竞技场TOP 10

微软明星大模型WizardLM一作全员加入腾讯混元,最成果Hunyuan - Turbos跻身大模型竞技场TOP 10。此前WizardLM - 2发布不顺,且微软将裁员超6000人,国内大厂正激烈争夺大模型人才。

量子位
产品应用8

数学奥赛高分摘金,位列大模型榜首,『书生』科学多模态大模型Intern-S1力再升级 | 通专融合进展

2025年CMO决赛首设AI测试,书生科学多模态大模型Intern-S1以102分位列大模型得分榜首,远超金牌线和国家集训队入选线。其推理力提升得益于多项创,未来将拓展至多领域科研。

OpenMMLab
算法论文8

别再只关注KV Cache了! LLM稀疏性洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案

团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还识别关键结构、找到最优压缩策略,设计的UNCOMP框架优化KV Cache,实验效果佳。

深度学习自然语言处理
开源动态8

SD又回来了!一秒出图,手机就玩:SD3.5-Flash让专业AI绘画进入“闪电”时代

Stability AI联合萨里大学SketchX实验室推出SD3.5-Flash模型,在普通电脑甚至手机上快速生成专业级高分辨率图片。它将推理步骤压缩、显存要求降低、出图时间大幅缩短,画质也没明显缩水,还在性上反超SD3.5M。

AIGC开放社区