两小时学习法」共找到 2344 篇相关文章

算法论文8

双管齐下:联邦学习防投毒攻击与梯度泄露,华南理工深北莫研究成果登上TMC与IoT

随着联邦学习在物联网系统广泛应用,数据隐私保护成难题。华南理工大学与深圳北理莫斯科大学合作,提出FedMSBA和FedMAR种防御方法,分别解决参与方梯度泄露和服务器受攻击问题,在多方面实现突破。

新智元
开源动态8

LeCun世界模型出2代了!62小时搞定机器人训练,开启物理推理新时代

Meta开源发布V-JEPA 2世界模型,图灵奖得主Yann LeCun称其将为机器人技术带来新时代。该模型能理解物理世界,经训练后在多方面表现优异,Meta还发布新基准测试,也透露了后续计划。

量子位
开源动态8

1.4K标星!微软开源了一款全能AI客服系统,一键24小时实时对话!

数字化时代传统呼叫中心问题多,成本高。微软在GitHub开源Call Center AI,基于Azure + GPT的智能语音客服系统,具多项功能,采用三层设计,适用多行业,可落地,或成企业标配。

开源星探
算法论文8

阿里巴巴新论文:让LLM学会管理记忆,告别人工规则

大型语言模型处理长对话或复杂任务时,记忆管理靠人工规则,效果有限。阿里巴巴团队新论文提出把记忆管理变为可学习的强化学习策略,AgeMem框架统一长短期记忆管理,经三阶段训练,效果显著。

AI工程化
开源动态8

群核科技开源款空间大模型,想解决 Genie3 没能彻底解决的问题

2025年8月25日群核科技举办TechDay,发布专注3D室内场景的空间大模型,开源SpatialLM 1.5和SpatialGen。款模型分别解决理解交互和空间一致性问题,有实际应用价值,还介绍了数据飞轮效应及模型相关问答。

Founder Park
算法论文8

英伟达再出手!新型混合架构模型问世,大创新实现53.6倍吞吐提速

英伟达研究者提出新混合架构语言模型 Jet - Nemotron,在达 SOTA 全注意力模型精度时效率卓越,2B 版性能超 Qwen3 等,H100 GPU 上生成吞吐量最高加速 53.6 倍,基于 PostNAS 和 JetBlock 大创新。

机器之心
推荐文章8

全球爆红后,Clawdbot之父2小时深度专访:退休3年后我杀回江湖

新智元对Clawdbot之父Peter Steinberger进行近2小时专访。他分享AI编程工作流,如一天600个Commit、让AI验证代码、用多个Agent并行开发。他还讲述经历,认为AI时代程序员要关注系统架构,强调与AI融合。

新智元
产品应用7

真·养虾!3步让龙虾边聊边进化,不用GPU不用数据集就能强化学习

程序员给智能体套在线强化学习系统MetaClaw,把用户与AI对话变训练数据。它基于Kimi - 2.5,用SkillRL框架,不依赖本地GPU,训练交Tinker云平台,三步即可上手。

量子位
开源动态8

OpenClaw 能“边用边训”了:智能体强化学习训练框架 AReaL v1.0 稳定版发布

3月4日,蚂蚁集团联合清华发布开源强化学习训练框架AReaL v1.0稳定版,主打‘Agent一键接入RL训练’。它解决现有智能体框架接入训练成本高、缺乏持续进化能力的问题,还推出原生训练引擎Archon,集成AI辅助开发体系。

InfoQ
推荐文章8

拿到DeepMind、Meta等多家Offer后,她把机器学习求职面试的真相写了出来

牛津大学博士生Silvia Sapora把机器学习求职面试经历原原本本写在博客中。她分享面试准备技巧、心态与谈判策略,提醒一次面试表现不定义研究者价值,该文对求职者或许比题库更有用。

机器之心