「底层系统能力」共找到 4711 篇相关文章
英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限
学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。
Claude 5.1双旗舰突然发布:跑分屠榜,反蒸馏,科研能力大幅跃升,缓存费用暴降75%
Anthropic发布Claude Fable 5.1和Claude Mythos 5.1两款大模型,性能登顶且解决开发者关注问题。缓存读取费用降75%,跑分屠榜,科研能力强,安全系统重构,合作实测效果好,盲测风格与GPT - 5.6 Sol不同。
抗干扰能力提升近40% !无需对抗训练,北航上海AI Lab新蒸馏方法提升模型鲁棒性 | ICML 2025
在人工智能模型规模持续扩大的今天,数据集蒸馏方法能提升训练效率、降低成本,但蒸馏模型在安全性要求高的任务中抗干扰难。北航上海AI Lab团队提出ROME方法,无需对抗训练,显著提升模型鲁棒性,成果被ICML 2025接收且已开源。
Anthropic宣布练出神话级模型:Claude Mythos,代码和黑客能力吊打opus4.6,不向公众开放!
Anthropic宣布Project Glasswing计划,因训练出超强模型Claude Mythos Preview。该模型代码和推理能力超opus 4.6,扫描主流软件发现数千零日漏洞。此模型不向公众开放,计划先在Claude Opus验证安全机制。
我拥有了超能力!Meta最牛文科生让3个AI互掐,竟造出1人技术部
Meta产品经理Zevi Arnovitz零技术基础,借助Cursor和Claude治愈代码恐惧。他分享经历,用管理团队方式管理AI,建立开发流,还让AI互审代码。AI正让普通人构建未来,职场需全能构建者。
谷歌 Cloud AI 总监 14 年血泪复盘:AI 时代工程师不可替代的 5 类能力,代码反而排在最后
谷歌 Cloud AI 总监 Addy Osmani 复盘 14 年谷歌职场,指出在大厂代码非决定工程师发展的关键,分享 21 条心得,如用户至上、携手求真等,助工程师少走弯路。
鸿蒙元服务的“体验密码” | 从京东到深圳万象城,看技术底层如何让服务直达用户
AI时代,系统能感知用户场景与需求,主动推送服务。鸿蒙元服务解决用户体验痛点,其技术底座帮开发者“减负”。如京东复用代码,深圳万象城优化停车服务,还为中小商户提供零代码开发方案。
R-HORIZON:长程推理时代来临,复旦NLP&美团LongCat重磅发布LRMs能力边界探测新范式
复旦大学与美团LongCat Team联合推出R - HORIZON,它是首个系统性评估与增强LRMs长链推理能力的方法与基准。提出Query Composition方法构建评测基准和训练数据,评测发现主流模型长链推理性能断崖式下降,还分析出三大瓶颈,训练后模型性能双重提升。
AI Agent如何重构企业核心系统?深度拆解Agent、多模态与组织变革的实战路径|AICon
12月19 - 20日北京举办的AICon大会,围绕AI Agent等展开探索。来自腾讯等企业的人士将分享构建智能系统经验。大会有Keynote、平行技术专场、晚场辩论等,涵盖多领域议题,为参会者带来前瞻思想盛宴。
陶大程技术博客首发:从像素复刻到行动控制,具身世界模型的底层逻辑探索|甲子光年
今年世界模型成AI热点,通用世界模型追求像素逼真,具身世界模型不同,其使命是支撑行动。文章拆解具身世界模型底层逻辑,分享开悟世界模型的技术设计与实践思考。