「穿孔反向传播」共找到 87 篇相关文章
The Batch: 917 | 全球 AI 峰会彰显乐观态势
第四届全球人工智能峰会在新德里举行,议题从理论风险转向推动AI惠益全球传播。逾85国背书《新德里人工智能影响力宣言》,顶级AI企业布局印度,人权组织批评峰会在权利保护上收效甚微。
10万token自然语言推理,让30B-A3B模型站上奥赛金牌线
上海人工智能实验室报告显示,30B - A3B规模的SU - 01模型不依赖外部工具,经训练在IMO、USAMO、IPhO等奥赛评测达金牌水平。研究还验证更高效科学推理系统路线,有望用于更多科学问题。
清华联手英伟达打造扩散模型新蒸馏范式!视频生成提速50倍,4步出片不穿模
清华大学朱军教授团队与NVIDIA Deep Imagination研究组联合提出分数正则化连续时间一致性模型(rCM),将连续时间一致性蒸馏扩展至大模型,解决现有方法瓶颈,提升推理速度兼顾质量与多样性。
ChatGPT到底学了多少「污言秽语」?清华团队首提大语言模型中文语料污染治理技术
清华等团队研究发现,先进ChatGPT系列模型中文词表污染达46.6%,含色情、赌博等词元。团队定义分类中文污染词,构建识别模型,还能由词表污染估计数据污染,为语料治理提供方案。
日本AI王者,CTO是Transformer之父,刚拿下世界编程竞赛冠军
在ICFP 2025编程大赛中,日本Sakana AI的「Team Unagi」以人机共创模式夺冠。其AI系统「ShinkaEvolve」优化代码,性能提升近十倍,还启发人类思维。Sakana AI以自然进化为理念,探索AI新范式。
四川美术学院团队用AIGC“复活”千年非遗,时尚又未来!
四川美术学院汪泳教授团队发起“锦绣西南”项目,引入AIGC对古老织锦纹样创新演绎。该项目成果丰富,如科普网页、AR应用等,还获阿里云支持,探索非遗传承、传播与应用新路径。
昨日,AI内容新规正式实施,这次不注意是真的会违法。
9月1日,《人工智能生成合成内容标识办法》及配套国标正式执行。新规规定AI模型或应用提供方要给生成内容打“显式”与“隐式”标识,对产品创业者、AI工具提供方和创作者等提出不同要求。
英伟达官方推理指南来了!6倍无损加速,最优解全是华人写的
9月2日,英伟达技术博客上线《用投机解码做AI模型协同设计》,给出推理加速选型表。列入指南的核心方案多由华人团队主导,介绍了从外置草稿模型到n - gram查表法等方案,还提到硬件常数对模型架构的约束。
为训推加速!全新FlashQLA注意力算子库开源
自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。
对话 Roto:让视频实时可交互、足够个性化,我们要做 AI 时代的 Netflix
Roto定位是全球首个互动开放世界视频平台。创始人David Xu曾就职独角兽企业,涉足多模态生成。团队经多次方向调整,决定大胆探索极致创新。目前产品技术不成熟,但已探索新内容形式,还将在广告实现商业闭环。