「三域融合大模型」共找到 8462 篇相关文章
备受Meta折磨,LeCun依旧猛发论文!新作:JEPAs不只学特征,还能精准感知数据密度
备受Meta审核规定“折磨”,LeCun仍发新论文。其团队发现自监督模型JEPAs学会了数据“密度”,打破学界以往认知。还提出JEPA - SCORE工具,经多组实验验证其效果。
泛化性暴涨47%!首个意图检测奖励范式,AI工具爆炸时代意图识别新解法
随着大模型和工具增长,AI 助手意图识别遇新挑战。腾讯 PCG 团队用强化学习等方法,提升模型泛化能力,还从多方面剖析优势,最后提出未来研究方向。
在 AI「囤粮潮」里,拆解智谱 50 亿美元的「技术账本」
AI行业进入下半场,竞争重心转向持续迭代能力,本文围绕智谱50亿美元融资事件,拆解其资金投向与技术布局,分析头部大模型厂商的竞争逻辑。
当万相2.5刚开卷有声视频,7月已经发布音频一体化的百度蒸汽机又开卷长视频了
百度升级MuseSteamer蒸汽机视频生成模型,可生成任意长度视频,生成中能更新prompt交互创作。其技术规划前瞻体系化,成本低,在多行业有应用和商业化空间。
三重激励+全周期扶持,即梦升级这个计划,让AI创作者的成长有迹可循
即梦AI创作者成长计划全面升级,构建覆盖三阶段的扶持体系,提供多维资源。该计划通过三重激励机制助创作者增收,还打造优质社区,持续开放至2025年12月。
隐私堡垒!Presenton开源革命:本地AI生成PPT,敏感数据永不触网!
本周GitHub新开源项目Presenton可离线制作PPT,支持主流AI模型,本地运行保护数据隐私,有灵活自定义模板和API集成功能,还具备多模型支持、主题定制等特性。
全球基模决战!AI圈休不了十一长假了
本文爆料中秋国庆假期前后,海内外多家AI巨头扎堆筹备发布新一代大模型,梳理了硅谷和国内厂商的最新进展,堪称AI圈「基模决战周」。
写给Agent的Loop,关键不在循环那六行代码本身
最近‘别再一句句给Agent写提示词,去写循环’说法火了。虽循环代码简单,但关键在模型周围。循环工程有四大难点,角色也从操纵Agent变为设计系统,不过此说法也有反对声。
Sand.ai开源发布MagiCompiler:突破局部编译界限,定义训推性能上限
大模型开发者面临速度与显存的两难选择,原生torch.compile有局限。Sand.ai开源MagiCompiler,突破传统编译界限,提出Compiler as Manager理念,解决算力与显存墙难题,性能实测亮眼,且接入简单。
ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍
文章聚焦HyperGraphRAG模型,介绍其架构由知识超图构建、超图检索策略、超图引导的生成机制组成,阐述构建步骤,该模型能提升检索效率,或成ACL 2025爆款。