无掩膜训练范式」共找到 2844 篇相关文章

推荐文章7

agent未来落地的收敛形态

当前agent开发变重,基模优化与agent开发脱钩。后续落地的技术收敛范式是将基模训练和agent开发有机结合,有模型更小、agent更智能、基模深入业务场景带来新想象力等好处。

Agent的潜意识
开源动态8

字节跳动开源文档解析大模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!

字节跳动开源文档解析大模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。

小华同学ai
产品应用8

8块钱跑通一次强化学习全流程,潞晨云重塑微调赛道:1名算法工程师=1支Infra团队

大模型下半场,后训练特别是强化学习成核心战场。潞晨云微调SDK上线,它是国内首个全面开放、且兼容Tinker范式的Serverless微调平台,为强化学习提供低成本解法,在易用性和成本上有优势。

量子位
算法论文8

经典之作!Agent无需奖励也能学习:通过“早期经验”的Agent Learning

该论文提出‘早期经验’范式,让智能体通过执行动作、观察结果状态学习,无需外部奖励。它能降低数据依赖,提升泛化与鲁棒性。实验显示,其在多样环境中效果出色,为智能体训练提供新思路。

深度学习自然语言处理
算法论文8

无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」

清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率与通用性痛点。

机器之心
开源动态8

智元机器人发布并开源首个机器人动作序列驱动的世界模型

智元机器人发布并开源全球首个基于机器人动作序列驱动的具身世界模型 EVAC 及具身世界模型评测基准 EWMBench,构建全新开发范式,解决具身智能演进制约,提升策略模型筛选与训练效率。

InfoQ
新闻资讯8

直面LeCun愿景,智在无界发布最强具身世界模型,20万小时人类视频屠榜6大榜单

智在无界作为人类视频学习路线开创者,4月14日发布第三代旗舰模型Being - H0.7,用20万小时人类视频训练,提出新范式,在6项权威评测中综合排名全球第一,拓展了世界模型能力边界。

机器之心
新闻资讯7

新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了

“欧洲的OpenAI”Mistral AI发布首款推理模型Magistral,却再遭质疑未与最新版Qwen和DeepSeek R1对比。该模型亮点是支持多语言推理,以纯RL方式训练,为LLM强化学习提供新范式

量子位
新闻资讯8

2026CSDI:AGI前夜,属于懂Agent、更懂模型的长期深耕企业

本文围绕2026年AI行业发展展开,指出竞争基本单位正从模型变为体系,AGI成组织目标,同时介绍了算力、数据等核心要素变化;还提及Agent与模型关系及编程新范式,最后宣传了2026CSDI峰会。

AIGC开放社区
开源动态8

小米陈龙团队首作:统一具身与自动驾驶的开源模型

小米具身智能团队发布首篇论文,提出统一具身智能与自动驾驶的新模型MiMo-Embodied。该模型在多任务中领先,其四阶段训练框架打通两领域边界,为行业提供新范式

AI科技评论