大模型后训练」共找到 9494 篇相关文章

新闻资讯7

Meta发布40页报告,具身智能的下一步是「心智世界模型」:能听,能看,能理解,会共情

Meta发布40页报告,首次将对人心智状态的推断概念化为心智世界模型,与物理世界模型实现“双轨建模”。还指出要结合系统A和B让AI自主学习,心智世界模型在多智能体协作潜力

量子位
开源动态8

“AI神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!

7月23日,“AI神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在多个测评中成绩领先,有多种能力,李沐介绍其技术及训练方法。

AI前线
算法论文8

上科何旭明团队新作:克服简单样本偏置,让多模态模型学会「难题优先」

上海科技学何旭明团队针对多模态模型幻觉问题,提出DA-DPO框架。该方法不依赖额外人工标注,通过动态调整样本权重,缓解简单样本偏置,在降低幻觉率同时提升综合能力,具成本效益。

AI科技评论
算法论文8

用155万模拟视频给模型上课!GVE模型一次学会9种视频检索技能

当前视频检索研究陷入困境,现有模型难以应对复杂检索需求。香港科技学(广州)联合阿里巴巴通义实验室推出通用视频嵌入模型GVE,其在零样本设置下超越14个主流模型,全链条创新为视频检索通用化奠定基础。

量子位
算法论文8

缺数据也能拿SOTA?清华&上海AI Lab破解机器人RL两瓶颈

现有机器人视觉 - 语言 - 动作(VLA)模型训练范式存在数据采集成本高、泛化能力不足等问题。清华和上海AI Lab团队提出SimpleVLA-RL,解决了VLA模型训练的核心瓶颈,在多基准测试中实现SoTA性能。

量子位
新闻资讯8

CVPR史上首次!中国车厂主讲AI模型,自动驾驶也玩Scaling Law?

世界计算机三顶会之一CVPR 2025落幕,小鹏汽车作为唯一受邀车企,其世界基座模型负责人发表演讲分享成果。小鹏用强化学习打造‘AI脑’,还自研‘世界模型’,从云到端全流程优化,展现中国车企在自动驾驶的创新实力。

新智元
8

现实版“盗梦空间”?欧洲极客论文全网爆火,一战戳破三巨头安全神话,35万机密在公网裸奔

欧洲两位安全研究员的论文《从专有 LLM API 中窃取推理轨迹》爆火。他们揭示 OpenAI、Anthropic 和 Google 用的“无状态架构”有漏洞,能利用小模型解码模型推理轨迹,导致隐私泄露等风险。

AI科技大本营
推荐文章8

阿里云 CIO 蒋林泉:AI 模型时代,我们如何用 RIDE 实现 RaaS 的首次落地?

阿里云 CIO 蒋林泉分享模型落地实践,指出 AI 是时代“电梯”,企业需迅速搭乘。介绍阿里云数字人多场景应用成果,提出 RIDE 方法论助企业落地,还剖析翻译与 Agent 模式要点及 E2E 落地关键。

阿里云开发者
开源动态8

2026 AI 模型技术体系综合开源影响力榜单发布,中国开源实力领跑全球

2026年全球AI产业迈入新阶段,开源生态影响力成关键。4月17日CSDN联合多家机构发布《2026模型技术体系综合开源影响力榜单》,从四维度、53项细分指标评估,呈现开源生态地图,助力中国AI开源跨越。

AI科技大本营
新闻资讯8

李飞飞首个多模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界

李飞飞创办的 World Labs 发布多模态世界模型 Atlas,可原生处理多类型数据,有世界生成、重建和模拟等能力。还介绍其研发历程、技术特点,以及 World Labs 收购、融资等情况。

InfoQ