知识扩散」共找到 727 篇相关文章

新闻资讯7

The Information:OpenClaw 在中国AI圈的发酵和扩散速度,远超硅谷想象

The Information报道称,OpenClaw在中国AI圈发酵和扩散速度远超硅谷想象。字节、阿里、腾讯在云平台上线其服务,开发者可云端运行。围绕它的生态在中国疯狂生长,还渗透到硬件领域,对创业者是不可逆冲击。

Founder Park
算法论文8

英伟达、港大等发布创新KV缓存,实现扩散模型无训练加速

多数开源扩散语言模型推理效率不如自回归模型,英伟达、港大、麻省理工研究人员联合提出Fast - dLLM。它用近似KV缓存机制减少冗余计算,还提出基于置信度的平行解码策略,测试显示能加速且保持生成质量。

AIGC开放社区
新闻资讯7

突发,美商务部叫停「AI扩散规则」藏杀机!英伟达市值再破3万亿

13日晚美商务部撤销《AI扩散规则》,该规则曾遭科技巨头和盟友反对。同时出台加强半导体出口管制新措施,精准打击中国AI发展。而英伟达因规则废止受益,市值再破3万亿。

新智元
算法论文8

其实,扩散语言模型在最终解码之前很久,就已确定最终答案

随着扩散语言模型(DLM)发展,它成自回归(AR)模型有力替代。但实际推理慢于 AR 模型。研究者发现早期答案收敛现象,提出 Prophet 策略,实验显示其能在保持高质量生成时显著加速推理。

机器之心
新闻资讯8

2年内AI生成世界90%知识!老黄2小时重磅访谈「剧透」未来

新智元报道黄仁勋2.5小时访谈,他透露2 - 3年内90%知识或由AI生成,强调AI尽头是能源,提出通用高收入概念,还分享英伟达危机、童年经历,解答AI意识、失控等问题。

新智元
算法论文8

dLLM的「Free Lunch」!浙大&蚂蚁利用中间结果显著提升扩散语言模型

近年来,扩散大语言模型(dLLM)成为文本生成新势力,生成效率高。但现有解码策略忽视中间迭代信息,研究团队观察到「先对后错」现象,提出 TCV 和 TCR 方法,显著提升模型在推理任务表现。

机器之心
算法论文8

一键开关灯!谷歌用扩散模型,将电影级光影控制玩到极致

Google推出LightLab项目,可从单张图像精准控制光影,解决传统光影控制难题。其通过特殊数据集微调扩散模型,让模型学会控制光照,还介绍了方法、后处理流程等,实验显示表现优,有多种应用。

机器之心
算法论文8

推理效率狂飙60倍:DiDi-Instruct让扩散大模型16步超越千步GPT

普渡大学等研究者提出 DiDi-Instruct 后训练方法,可将扩散大语言模型推理加速 60 倍,超越传统 GPT 模型。该方法实现推理效率与效果双提升,为大语言模型落地提供新方案。

机器之心
开源动态8

华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」

今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在多基准创 7B 参数量级 SOTA,还解析了其技术革新。

机器之心
算法论文8

AST | 西工大马龙、邬晓敬等:几何特征知识驱动的代理优化方法

机器学习为气动外形设计提供新方法,但高效挖掘利用几何与气动数据知识是难题。本文提出气动监督自编码器架构,利用小样本气动数据监督学习几何特征,嵌入优化框架提升样本质量及优化效率,经翼型和机翼验证有效。

力学与人工智能