多阶段训练」共找到 5961 篇相关文章

算法论文8

仅有一位作者的论文,却补上了城市智能的「最后一公里」

郑宇教授用论文提出跨域模态知识融合框架,在空气质量推断等场景优势明显,其研究按数据选择等四阶段进行,解决数据难题,推动AI用于城市问题,为跨部门协作提供可能。

AI科技评论
算法论文8

ScreenCoder:视觉-代码对齐新范式,为模态程序合成开辟道路

前端开发中UI转代码耗时易错,现有工具存在不足。ScreenCoder提出模块化智能体框架,通过三阶段分工协作实现代码生成,还构建数据引擎推动VLMs进化,实验表现出色,为模态程序合成开辟道路。

深度学习自然语言处理
算法论文8

一个模型装下整个物种树!伯克利GPN-Star斩获基因预测双料冠军

加州大学伯克利分校等机构推出基因组语言模型GPN - Star,可将全基因组比对和物种树信息装进大模型。它克服传统GLMs短板,实现三点升级,在基准测试表现出色,是强大的全基因组变异解读框架。

新智元
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在模态基准测试中表现优异,尤其小规模模型性能突出。

新智元
开源动态8

狂揽4万星!换掉OpenClaw太爽了,5美元就能养个AI打工人

Hermes Agent是NousResearch推出的开源Agent神器,上线后在GitHub超4万星。它运行在用户服务器,有六大核心特性,能跨平台对话。技能自维护,形成记忆 - 技能 - 训练数据闭环,应用场景丰富,演进注重安全、稳定与智能。

新智元
开源动态8

流式数据集:效率提升 100 倍!

现在只需一行代码,就能通过 `load_dataset('dataset', streaming=True)` 以流式方式加载数据集,无需下载。Hugging Face 优化后端,提升流式数据集速度与效率,减少请求、提升解析速度,还优化启动和流式加载阶段

Hugging Face
算法论文8

模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安全」二选一

上海人工智能实验室等团队提出LED - Merging解决模型融合“安全 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安全性,论文已被ACL 2025 Main Conference接收。

深度学习自然语言处理
算法论文8

跳出「黑盒」,人大刘勇团队最新大语言模型理论与机理综述

大语言模型工程成功但理论研究滞后,被视为「黑盒」。人大刘勇团队用生命周期分类法,将LLM理论研究整合为六阶段,系统综述底层理论与机制,指出前沿挑战,为其向严谨科学转型提供路线图。

机器之心
产品应用7

Claude Code 强大的秘密究竟是什么?

Claude Code 强大源于其强大模型基础、丰富实用的内置工具、不压缩上下文信息及无 IDE 包袱等优势。相比之下,OpenAI 的 Codex 因模型能力、强化训练不足等落后,Anthropic 还靠亏本推广积累数据。

宝玉AI
开源动态8

告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent

现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。

量子位