弱到强监督」共找到 2276 篇相关文章

算法论文8

大模型赋能的具身智能:自主决策和具身学习技术最新综述

具身智能是通往通用人工智能的关键路径,但传统方法有泛化瓶颈。电子科大最新综述梳理大模型赋能具身智能的自主决策与具身学习,还将‘World Model’纳入统一框架,为研究者提供路线图。

PaperAgent
开源动态8

SGLang 2025-8月性能优化技巧记录

本笔记记录2025年8月SGLang框架性能优化实践,涉及GPT - OSS、DeepSeek - V3等模型,采用allreduce_add_rmsnorm、量化、通信、内核融合等优化技术,在性能提升、减少延迟等方面效果显著。

GiantPandaLLM
算法论文8

真实场景也能批量造「险」!VLM+扩散模型打造真实域自动驾驶极限测试

浙江大学与哈工大(深圳)联合推出SafeMVDrive,将VLM关键车辆选择器与两阶段轨迹生成结合,可在真实域批量制造高保真安全关键视频,用于端端自动驾驶系统安全性测试。

新智元
算法论文8

简单即强大:全新生成模型「离散分布网络DDN」是如何做原理简单,性质独特?

本文作者杨磊介绍全新生成模型离散分布网络DDN,它建模目标分布机制简洁独特,有零样本条件生成等特性。文中详述其原理、网络结构、损失函数,还展示实验效果,最后给出未来研究方向。

机器之心
新闻资讯7

奥特曼爆冷改口:AGI没用?MIT预测2028年降临,50%概率

我们越来越接近AGI,时间表从50年缩5年,大佬预测2026、2028年降临。但AI在ARC测试得分0%,人类基本能力似新手。算力战已打响,AGI或需架构革命和技术集体转向。

新智元
新闻资讯8

OpenAI杀疯了!内部神秘模型首次斩获信息学奥赛IOI 2025金牌,碾压98%人类选手

OpenAI研究员官宣其内部研发的AI推理系统在2025年国际信息学奥林匹克竞赛获金牌,超越98%人类选手。该系统在模拟人类环境下靠推理解题,用通用模型,一年间成绩大逆转,近期在多赛事表现出色。

AI寒武纪
推荐文章7

AI竞赛下半场:为什么说“超级工厂”是最优解?

2025年夏天,巨头们因Agent的崛起对AI热情高涨,砸钱堆算力的背后是算力供不应求的困境。云计算因其具备极致的规模化、先进的生产工艺、柔性生产、智能管理和生态链接能力,被认为是AI的“超级工厂”。阿里云作为实例,展示了其完整的AI生产体系。

InfoQ
新闻资讯7

全网苦等GPT-5,超级对齐团队遗作成重要线索,奥特曼发话「惊喜很多」

AI圈聚焦GPT - 5,相关爆料多但模型未现。奥特曼称有很多惊喜。GPT - 5疑似技术通用验证器源于OpenAI论文,或代表AI发展进入新的架构突破时代。此外,有博主用疑似GPT - 5创作,效果惊人。

机器之心
开源动态8

Qwen全面升级非思考模型,3B激活、256K长文、性能直逼GPT-4o

Qwen全新非思考模型Qwen3-30B-A3B-Instruct-2507上线,仅激活3B参数,性能媲美顶尖闭源模型。相比前代,推理、对齐和长文本处理能力大幅提升,在通用能力上也全面进步,适合复杂人机交互应用。

量子位
算法论文8

抗干扰能力提升近40% !无需对抗训练,北航上海AI Lab新蒸馏方法提升模型鲁棒性 | ICML 2025

在人工智能模型规模持续扩大的今天,数据集蒸馏方法能提升训练效率、降低成本,但蒸馏模型在安全性要求高的任务中抗干扰难。北航上海AI Lab团队提出ROME方法,无需对抗训练,显著提升模型鲁棒性,成果被ICML 2025接收且已开源。

量子位