多模态微调」共找到 1187 篇相关文章

开源动态8

快手在 AI 上,渐入佳境

文章介绍快手多模态大模型 Keye-VL 1.5,参数 8B 适合中小企业。它侧重短视频场景,视频理解能力强,能与业务结合,提升推荐等场景效率。还详述其架构、预训练、后训练及训练架构优化等技术细节。

MacTalk
算法论文8

MSRA首测AI从零建仓库:能写、能跑,但不一定对丨ACL'26

微软亚洲研究院工作RepoGenesis被ACL 2026高分录用,它是面向多语言、仓库级、端到端Web微服务生成的基准。输入贴近实际,用多维度评测开源Agent和商业IDE,还拓展模型微调。但也有边界,未模拟真实复杂需求。

量子位
算法论文8

ICML 2026 | 华为GTS提出AI训练数据新方法,Amazon/Google作者团队「光速跟进」:难度自适应训练正在成为新范式

华为GTS研发部AI数据团队提出EDCO方法,将样本难度估计与动态课程编排引入领域大模型微调。该方法用推理熵动态编排训练课程,让模型面对最有学习价值的样本,已被ICML 2026接收。

机器之心
产品应用8

告别 AI 土味审美!Kimi K2.5 实测:扔个视频复刻 iOS 级丝滑动效

Kimi 上线 K2.5 模型,前端审美佳,接近 Gemini 3,增强多模态识别,支持视频。测试显示它能按要求生成漂亮网页,还可通过反馈迭代。它对设计师和普通人帮助大,且 Agent 模式任务完成率高。

歸藏的AI工具箱
算法论文8

为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通大学

上海交通大学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态大模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。

量子位
算法论文8

奖励模型终于迎来预训练新时代!上海AI Lab、复旦POLAR,开启Scaling新范式

在大语言模型后训练阶段,奖励模型设计与训练是关键瓶颈。上海AI Lab、复旦推出预训练奖励模型POLAR,采用策略判别学习新范式,适配强化微调,性能和泛化能力强,为LLM后训练带来新可能。

机器之心
产品应用7

实测可灵O1,AI视频界的Banana也来了。

可灵推出全新多模态视频大模型可灵O1,融合多种视频生成与修改能力。实测显示,它能实现视频内容增删、特定内容修改、扣绿幕、动作迁移、风格更改等功能,虽有局限,但开启用嘴改视频新时代。

数字生命卡兹克
开源动态8

模仿人类推理修正过程,阶跃星辰提出形式化证明新范式 | 开源

阶跃星辰发布并开源形式化定理证明大模型 StepFun-Prover-Preview-7B 和 32B。采用两阶段监督微调、工具集成强化学习及 RL 与 SFT 迭代循环优化等策略,在基准测试集表现佳,还展示多个证明案例。

量子位
产品应用7

Seedance 2.0现象级刷屏!深度测评:复杂场景贼稳,连asmr都会?

字节上线的Seedance 2.0全网刷屏,马斯克怒赞,外国网友催更。它在多模态输入上升级,画面一致性更稳可控,还有一镜到底、完整剧情输出功能,视频长度和音效也能DIY,虽有小bug,但日常创作够用。

量子位
开源动态8

美团新独立APP,点不了菜只能点AI

美团新开源LongCat-Flash-Omni模型,支持多模态,在全模态基准测试达开源SOTA水准,推理快且全模态能力强。实测交互体验丝滑,其迭代逻辑清晰。该模型成功源于架构创新,美团靠软硬件结合实现虚实连接。

量子位