多模型适配」共找到 9713 篇相关文章

开源动态8

蚂蚁开源世界模型LingBot-World:具有分钟级记忆的实时世界模拟器

蚂蚁集团旗下灵波科技开源具身智能模型及世界模型LingBot-World,它将视频生成模型进化成可交互世界模拟器,采用阶段进化策略,有涌现记忆等能力,虽有不足,但为开源社区构建世界模型迈出坚实一步。

AIGC开放社区
开源动态8

终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成

过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。

量子位
产品应用8

智谱GLM-5.1深度评测:8小时连续工作,开源大模型进入"工程交付"新纪元

2026年4月8日智谱发布GLM-5.1,它是全球首个通过真实工程任务验证8小时持续工作能力的开源模型,在SWE-Bench Pro上超越GPT-5.4等登顶。该模型性价比高、技术创新,还适配国产硬件,开源生态友好。

机器学习AI算法工程
算法论文8

合成数据>人工数据,绝对性能暴涨超10个点!仅需任务定义,高效微调大模型

为解决基础模型在专业领域表现不佳、依赖人工标注数据的难题,北大、MIT等机构提出「合成数据强化学习」框架。该框架仅需任务定义,能生成合成数据微调模型,在领域基准上性能提升显著,代码已开源。

新智元
新闻资讯8

Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键

Anthropic 两位研究员在采访中表示 2025 年强化学习在大语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与模型交互、模型可解释性等,认为未来会有白领 AI 员工。

Founder Park
算法论文8

首次!世界模型、动作模型融合,全自回归模型WorldVLA来了

阿里巴巴达摩院提出全自回归模型 WorldVLA,首次融合世界模型与动作模型,统一文本、图片、动作理解和生成。它用独立编码器处理模态数据,还提出策略解决误差累积问题,实验表现优异。

机器之心
开源动态8

模型即智能体,Kimi K2 Thinking项评估超越顶尖闭源模型,300轮工具调用不疲倦

月之暗面发布Kimi K2 Thinking,它是Kimi迄今最强开源思考模型,基于模型即智能体理念训练,可自主连续工具调用与轮思考,项评估超顶尖闭源模型,还实现原生INT4量化,提升生成速度。

AIGC开放社区
开源动态8

蚂蚁·安诊儿医疗大模型:正式开源并登顶权威医疗榜单

近日,蚂蚁集团联合浙江省卫生健康委开源自研的蚂蚁·安诊儿医疗大模型。它基于蚂蚁百灵大模型架构,经深度训练,是参数规模最大的开源医疗模型。该模型评测中表现出色,有三阶段训练流程,架构高效、推理快,已开源助力行业发展。

新智元
开源动态8

微软 SkillOpt:不动模型权重,只训练那份「技能说明书」

微软研究院 Yifan Yang 等人推出 SkillOpt,思路反直觉,不动模型权重,把「技能文档」当可训练参数。它在 52 个组合中表现最优,技能可迁移,代码已开源,还支持操作。

AI工程化
算法论文8

2026开年关键词:Self-Distillation,大模型真正走向「持续学习」

2026年刚开场,Self - Distillation成大模型领域高频词汇。传统强教师依赖范式难适配模型持续进化,MIT等顶尖机构发布三项成果,用不同方法实现自蒸馏,推动模型持续学习。

机器之心