领域大模型」共找到 9815 篇相关文章

算法论文8

ICML 2025 | 给AI装上「智能升级插件」!阿里安全-清华学D-MoLE让模型在持续学习中动态进化

近日,阿里巴巴集团安全部 - 交互内容安全团队与清华学联合研究成果被 ICML 2025 收录。他们提出 D - MoLE 框架应对多模态模型持续学习挑战,实验显示其性能优、训练快,还能用于提升阿里安全审核模型适应力。

机器之心
算法论文8

读万卷书,模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源

Meta超级智能实验室与牛津团队新论文发现,只见过文本的语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。

机器之心
算法论文8

ICLR 2026 Oral | 让模型学会“像法医般思考”,实现可解释、可泛化的深度伪造检测

生成式AI发展使深度伪造技术安全隐患受关注,现有检测器表现不佳。中科院自动化所联合蚂蚁集团提出Veritas框架,构建HydraFake数据集,赋予模型“模式感知推理”能力,实验效果超现有检测器,还给出未来研究方向。

深度学习自然语言处理
产品应用8

破解300年数学难题,智能体突破!谷歌发布超强AI Agent

今天凌晨谷歌Deepmind发布编程AI Agent——AlphaEvolve,它与Gemini深度集成,能评估算法。它解决了300多年的数学难题,还提出新算法,提升模型计算效率,可优化GPU指令,架构含多模块。

AIGC开放社区
算法论文8

NVIDIA港MIT联合推出Fast-dLLM v2:端到端吞吐量提升2.5倍

自回归语言模型推理效率受限,Fast - dLLM v2 由 NVIDIA、港、MIT 联合推出。它将预训练 AR 模型适配为能并行解码的 Block - dLLM,用约 1B tokens 微调,端到端吞吐量最高提升 2.5 倍,精度相当。

机器之心
算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭

近日MIT研究者发现测试时训练在模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元
算法论文8

斯坦福与Adobe新研究,模仿蒸馏技术轻松让200亿参数图像生成高质量模型

斯坦福学和Adobe研究院联手,用pi - Flow技术让200亿参数文本到图像模型4步内生成高质量、高多样性图片。此前少步生成有质量和多样性问题,他们推出GMFlow和pi - Flow解决难题,LakonLab是其背后工程支撑。

AIGC开放社区
算法论文8

为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通

上海交通学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。

量子位
开源动态8

开源AI引爆热潮!GOSIM AI Paris 2025首日直击:80+位技术咖聊模型、拼算力、秀落地

5月6日,GOSIM AI Paris 2025会在法国巴黎启幕,80余位技术专家与学者参会。GOSIM联合创始人认为开源AI已追上闭源,AGI或由多模型组成网络。会设四分论坛解析开源AI,还有特色单元,明日将迎PyTorch Day。

AI科技大本营
产品应用8

Seedance 2.0之后,又一中国视频模型SkyReels-V4登上全球第二

昆仑天工发布SkyReels V4视频模型,在Artificial Analysis Arena基准测试中排全球第二。它支持多模态输入、音视频同步生成等,采用独特架构与技术,经多阶段训练,有全新评估基准,表现出色。

AIGC开放社区