多阶段训练」共找到 5963 篇相关文章

新闻资讯8

预测太阳磁暴全球最强!首个空间天气链式AI预报模型亮相WAIC

在WAIC上,我国发布全球首个全链式空间天气AI预报模型“风宇”。它首创链式训练结构,整合孤立环节;基于天地一体化观测数据,在区域短临预测表现卓越,误差低,已申请项专利,还可用于航天器设计管理。

量子位
算法论文8

CVPR 2026 ReSAM:每个目标只标1个点,SAM就能学会分割遥感图像

CVPR 2026收录论文《ReSAM: Refine, Requery, and Reinforce: Self-Prompting Point-Supervised Segmentation for Remote Sensing Images》,提出让SAM每个目标只标1个点,通过R³循环自己生成高质量伪标签训练。在WHU建筑数据集上,1点标注与全监督差距仅1.3%,省99%标注成本。

机器学习AI算法工程
算法论文8

Meta超级智能实验室又发论文,模型混一混,性能直接SOTA

大语言模型训练依赖算力和时间,传统模型 Souping 采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。

机器之心
新闻资讯8

为什么AI大厂的人,都跑去做生命科学了?

越来越AI人才投身生命科学,创办数十亿美元估值公司。这是因训练通用模型门槛高,而生命科学技术可迁移、产业愿付费且有成功先例。新一代公司AI位置、融资、技术目标有变化,但仍面临数据和临床验证问题。

DeepTech深科技
开源动态8

不到百万级,看不见 MCP 的真实问题:创始人亲述这疯狂的一年

MCP 联合创作者 David 复盘其发展,从开源协议到行业事实标准,经历阶段演进。他指出做对死磕标准 HTTP,踩坑让关键能力成可选致双向能力被削,规模达百万级有扩展性问题,还谈及方面发展与规划。

InfoQ
算法论文8

斯坦福7B智能体全面超越GPT-4o,推理流登顶HF

传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在任务上超越GPT - 4o等大模型,为AI发展提供新思路。

新智元
开源动态8

清华开源首个股票k线大模型

清华开源首个股票K线大模型Kronos,是专为金融市场K线序列预训练的模型,处理金融数据高噪声特性。采用两阶段框架,有安装、预测步骤,还有批量预测方法,项目地址为https://github.com/shiyu-coder/Kronos。

GitHubStore
新闻资讯8

英伟达4B小模型击败GPT-5 Pro!成本仅1/36

英伟达ARC - AGI 2中,4B小模型NVARC以27.64%成绩力压GPT - 5 Pro登顶,单任务成本仅其1/36。亮点是零预训练深度学习法,还靠合成数据、测试时微调等策略。小模型特定领域优化后优势明显。

量子位
算法论文8

李飞飞、Jim Fan和徐丹飞联合重磅论文:机器人灵巧手,可能走错了路

李飞飞等学者联合发表论文,分析当前触觉融合方案缺陷,提出 T - Rex 架构。它改变触觉输入方式,使用新编码方法和数据集,经三阶段训练,在 12 项任务评测中平均领先 30 个百分点,也指出了局限与未来方向。

DeepTech深科技
新闻资讯7

当AI接管70%代码审查工作,剩下的30%才是 “地狱模式”

2024年初“Vibe Coding”成热词,其虽能快速验证想法,但在大型企业项目中“不可控性”凸显。亚马逊云科技研发的Kiro,尝试解决“从提示词到生产”的断裂问题。目前代码审查采用混合模式,AI仅处初级阶段

InfoQ