统一多模态基础模型」共找到 1753 篇相关文章

算法论文8

AI 也有长久记忆了!谷歌Nested Learning让AI拥有持续学习的生命力

Google Research科学家研究直指AI领域难题,其论文《Nested Learning: The Illusion of Deep Learning Architectures》已提交NeurIPS 2025。Nested Learning打破认知框架,提出三大核心贡献,构建HOPE架构,性能优越,将改变终身学习应用领域。

AIGC开放社区
新闻资讯7

PyTorch 基金会迎来 Ray 项目,并推出 Monarch 简化分布式 AI 开发

2025 年 PyTorch 大会上,PyTorch 基金会宣布 Ray 项目加入,还推出 PyTorch Monarch 简化分布式 AI 工作负载。大会突显基础模型开发对透明度和可复现性的推动,基金会欲成开放式 AI 基础设施核心枢纽。

InfoQ
算法论文8

用更一致的轨迹、更少的解码步数「驯服」掩码扩散语言模型,扩散语言模型的推理性能和效率大幅提升

扩散大语言模型发展迅猛,或成下一代大语言模型基础范式有力竞争者。复旦大学等团队发布论文,提出高效解码策略与强化学习训练组合,解决MDLM解码和训练问题,提升推理性能与效率。

机器之心
算法论文8

更少的token生成更好的图!香港大学联合阶跃星辰等让AI绘画真正理解了再画

香港大学、阶跃星辰等用VFMTok新方法,让图像生成模型借用顶级视觉AI的眼睛看世界,实现更快、高质量图像生成,且无需复杂引导技巧。它改变图像理解方式,将像素死记硬背转为语义理解。

AIGC开放社区
开源动态7

Python只是前戏,JVM才是正餐!Eclipse开源新方案,在K8s上不换栈搞定Agent

近期,Eclipse 基金会在开源平台 Eclipse LMOS 推出‘代理定义语言’(ADL)。LMOS 项目旨在用统一、开放方式重构企业级 AI 代理开发与运维链路,对标专有平台与 Python 技术栈,避免企业‘推倒重来’。

InfoQ
算法论文8

内存直降50%,token需求少56%!用视觉方式处理长文本

在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。

新智元
新闻资讯8

首次公开!奥特曼重新发明了浏览器

OpenAI首个浏览器Atlas背后技术秘密公开,关键创新是全新架构OWL。它将Atlas应用与Chromium运行时分离,带来即时启动等优势,还为AI智能体用例奠定基础,重构了UI体验。

新智元
算法论文8

均值至上假繁荣!北大新作专挑难题,逼出AI模型真本事

当强化学习成大模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北大团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三大任务表现优异。

新智元
算法论文7

骂得越狠,ChatGPT回答越准!PSU研究实锤,狂飙84%准确率

宾夕法尼亚州立大学团队研究发现,对ChatGPT越粗鲁,它回答越准。实验用含50个基础问题的数据集,改写为五种礼貌等级共250个prompt测试,非常粗鲁时准确率达84.8%,非常礼貌为80.8%。

新智元
开源动态8

告别AI“乱画图表”!港中文团队发布首个结构化图像生成编辑系统

现有AI生图工具在结构化图像生成上问题多,理解与生成能力有鸿沟。港中文等校联合团队提出首个综合性方案,涵盖数据集构建、模型优化、评估基准三大模块,助多模态模型画准图,推动其发展。

量子位