「从零训练」共找到 4868 篇相关文章
数据蒸馏的双重突破:从几何保真到对抗鲁棒
深度学习中,数据集蒸馏可用精简合成样本替代庞大训练集且不牺牲模型性能,但面临精度和可靠性两大难题。两篇发表于 ICCV 2025 和 AAAI 2025 的论文分别给出解决方案,且代码已开源。
梅西投了李飞飞,她转身买下了一家机器人“训练场”
足球巨星梅西旗下体育科技投资平台 Play Time 投资了李飞飞的空间智能企业 World Labs。该公司今年 2 月获 10 亿美元融资后收购了 SceniX,以补足其机器人仿真短板。此前,Marble 虽能搭建训练场景,但没掌握物理规律。
从一行代码发现DeepSeek的秘密:Model1到底是什么?
在DeepSeek - R1发布一周年时,有人在GitHub的FlashMLA代码仓库发现神秘代号Model1,可能是V4。文章分析了代码仓库用途、新模型“露馅”原因,还从代码中发现Model1细节,结合论文梳理时间线,最后也提出了怀疑。
从答题到做实验:SciAgentGym让大模型进入科学工作流
复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。
终于学会“复盘”了!让智能体从“解题”进化到“进化”!
上海AI Lab和新加坡国立大学推出新框架RETROAGENT,让AI Agent学会“复盘”。它通过双重内在反馈复盘,提出SimUtil - UCB策略查记忆,在多项任务中碾压基线模型,使Agent从解题进化到进化。
训练机器人方式对了吗?英伟达DreamZero双榜第一新反思
NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。
科技赋能 未来已来 | 人形机器人训练中心探秘 @首钢园
文章探秘首钢园的人形机器人数据训练中心,提及机器人学习的情况,还列出了相关参考资料,展现科技赋能下人形机器人领域的发展。
Airbnb Istio 升级 14 次零宕机!Google、Uber、Netflix 都在借鉴
Airbnb engineering发布报告,介绍在数万Pod和数千VM上执行Istio升级且零宕机的方法。其设计升级流水线,用双版本部署和金丝雀发布策略等。还对比了Netflix、LinkedIn等公司的升级方式。
从 Rule、Spec 到 Harness:AI Coding 的渐进式建设路径
作者分享帮团队落地AI Coding经验,指出试点易但推广难,瓶颈在接收端。介绍从Rule、Spec、Loop到Harness的渐进式建设路径,各层前后相依,逐层收紧控制面,助AI在工程体系稳定交付。
想玩Loop Engineering,可以先从这6个Hook玩法开始。
Loop Engineering正火,入手可从Hook玩法开始。Hook是循环触发器,在Agent里很常见。文中整理了6个Claude Code的Hook玩法,如权限弹窗提醒、开机日程播报等,还提醒接入工作流要注意稳定性和边界。