「理论 - 实验学习范式」共找到 2540 篇相关文章
无损加速视觉语言模型推理!轻松剪掉视觉冗余Token|腾讯AI Lab
多图像、长视频让大型视觉语言模型推理成本暴涨,成算力瓶颈。腾讯AI Lab联合CMU提出VScan,通过两阶段视觉token筛选机制,在几乎不损性能的前提下实现推理加速,且已在GitHub开源。
刚刚,NLP先驱、斯坦福教授Manning学术休假,加盟风投公司任合伙人
NLP领域先驱、斯坦福教授克里斯托弗・曼宁从斯坦福休假,加入AIX Ventures任普通合伙人。他是将深度学习用于NLP的早期领军者,著作、课程影响大,此次转型将助力AI初创公司发展。
谷歌AI试穿神器真神了!上传照片秒出OOTD,视频效果和照镜子没区别
谷歌推出应用Doppl,上传照片就能看到衣服“穿”在自己身上的效果,还能生成动态视频。它不仅能试穿,还会帮忙搭配。此外,Google Labs还有Portraits、文生视频产品Flow等小实验。
模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安全」二选一
上海人工智能实验室等团队提出LED - Merging解决模型融合“安全 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安全性,论文已被ACL 2025 Main Conference接收。
75%预训练数据都能删!Jeff Dean新作:全自动筛除低质量数据
Google DeepMind团队开发的DataRater可全自动评估数据质量,用元学习筛选有价值数据,提升模型训练效率。它能减少计算量、提高性能,在低质量数据集效果佳,还能跨模型规模泛化。
Muon作者仅用一篇博客,就被OpenAI看中了
Keller Jordan 2024 年 12 月 8 日发布博客提出用于神经网络隐藏层的优化器 Muon,能提升训练速度。他未发论文,称只信速通。其案例显示 OpenAI 重能力。博客对前沿指标描述或过时,Muon 有诸多实证成果。
40岁开始预防衰老最有效!1.9万人脑扫描揭秘:大脑衰老有“关键窗口期”
一项发表于《美国国家科学院院刊》的研究,分析超1.9万人功能性磁共振成像,发现大脑衰老非线性,与胰岛素抵抗增加相关。还发现酮体可绕过胰岛素抵抗供能,40 - 59岁干预效果最佳。
谷歌 AI Studio 实时视频对话终于支持中文了!屏幕共享+语音,Gemini 2.5 Flash 原生音视频加持。
谷歌AI Studio实时视频对话支持中文,有Gemini 2.5 Flash原生视频对话模型。使用方便,还提供多种音色,有让模型在无声时发音视频等功能,可用于设计、学习、修电脑等场景。
让AI学着“看菜下碟”!港中大等新框架让推理长度减少90%,准确率反增17%
香港中文大学等研究者提出TON选择性推理框架,使视觉语言模型能自主判断是否推理。该框架有两阶段训练机制,实验显示其让推理长度最多减90%,准确率还提升,有益模型部署。
具身智能需要从ImageNet做起吗?
文章探讨具身智能发展,分析其爆发原因,如人类无法完全数字化等。指出几种失败模式,还讨论输入信号、触觉、学习方法等决策点,认为具身智能的‘ImageNet’时刻是伪命题,不同智能领域可能殊途同归。