SFT阶段」共找到 780 篇相关文章

推荐文章7

训具身模型遇到的很多问题,在数据采集时就已经注定了丨鹿明联席CTO丁琰分享

具身智能创企鹿明机器人联席CTO丁琰,分享具身智能数据采集现状、困境及新兴采集方式UMI。他强调具身模型问题多源于数据采集,还介绍鹿明产品FastUMI Pro,及其数据采集、模型训练生态。

量子位
算法论文8

复杂空间推理新SOTA,性能提升55%!中山大学新作SpatialDreamer

中山大学等机构推出SpatialDreamer,模拟人类空间认知过程,构建闭环推理流程,还提出GeoPO解决奖励稀疏问题,构建SpatialDreamer - SFT数据集。实验显示其在多基准达SOTA,为AI空间智能发展开辟新路径。

新智元
新闻资讯7

OpenAI这招太狠!AI从「躲猫猫」到「自爆黑料」,主打一个坦白

随着AI进入高风险场景,透明、安全变得重要。OpenAI提出「忏悔机制」,让模型回答后产出自我坦白报告,不影响主回答评分,只考察诚实,能提升不良行为可见性,目前仍处概念验证阶段

新智元
开源动态8

Svelte 团队成员开源新框架 Ripple,又一个想“改写前端”的框架?

Ripple是全新开源前端框架,由Svelte核心维护者打造,融合多框架理念,采用TS优先设计,有细粒度响应式机制等,目标是带来更简单开发体验,团队还探索集成AI能力,目前处于早期阶段

InfoQ
新闻资讯8

Scaling Law 仍然成立,企业搜广推怎么做才能少踩“坑”?

InfoQ《极客有约》X AICon 直播栏目邀请京东、荣耀等专家探讨生成式推荐落地洞察。指出搜广推领域 scaling law 仍成立,大模型改变特征工程等,还分享了系统架构、模型应用等方面经验及挑战。

InfoQ
新闻资讯8

谷歌新架构突破Transformer超长上下文瓶颈!Hinton灵魂拷问:后悔Open吗?

谷歌在NeurIPS 2025发布两项大模型新架构研究,通过‘测试时训练’机制,推理阶段可将上下文窗口扩展至200万token。新成果Titans和MIRAS结合RNN速度与Transformer性能,突破超长上下文瓶颈。

量子位
算法论文8

四足机器人首次同时「思考+走路」,北大提出链式推理MobileVLA-R1

在「大模型+机器人」浪潮中,让机器人既听懂话又走得对、稳很难。北大MobileVLA - R1将链式思考引入四足机器人,在仿真和真实实验中对标强基线实现提升,构建了更具工程可用性的范式。

新智元
新闻资讯7

2027年,人类最后一次抉择

Anthropic首席科学家Jared Kaplan预警,2027 - 2030年人类要抉择是否让AI递归自我进化。还介绍了AI进化三阶段,以及2027年关键的技术和硬件因素,同时Anthropic报告揭示AI对工程师工作的重塑。

新智元
开源动态7

Crossplane 从 CNCF 毕业,实现了生产环境成熟

云原生计算基金会(CNCF)毕业了 Crossplane 项目,标志其达到重要里程碑。它能将 Kubernetes 转成云基础设施通用控制平面,已通过多阶段,有众多贡献者与企业用户,虽有争议但发展前景好。

InfoQ
开源动态8

国产AI拿下国际物理奥赛金牌,13项顶级竞赛豪取12金1银,划重点:开源

上海人工智能实验室团队推出开源模型家族P1,在IPhO 2025理论考试中,P1-235B-A22B成首个达金牌线的开源模型。引入PhysicsMinions后成绩提升,在HiPhO基准排名第一,且全链路开源。

量子位