「渐进式训练」共找到 2703 篇相关文章
WithAnyone重磅开源:这可能是你见过最自然的AI合照模型
复旦大学携手阶跃星辰推出全新AI合照生成模型WithAnyone,它能生成自然、真实、毫无违和感的AI合照。该模型打破以往方法局限,当前ComfyUI版本已上线,还全面开源代码、模型权重等。
熬夜后走神不是你的错,而是自救机制在“洗脑” | Nature
麻省理工学院研究揭示,熬夜后白天易走神是因大脑“洗脑”机制启动。正常“洗脑”在睡眠时进行,清理废物;睡眠不足时,白天也会启动,代价是注意力受损。此前波士顿大学也有大脑清洁相关研究。
智源开源EditScore:为图像编辑解锁在线强化学习的无限可能
北京智源研究院团队发布 EditScore 高保真奖励模型系列,为图像编辑强化学习提供精确奖励信号。团队提出两步解决方案,开发出 EditScore 系列模型,其在多方面表现优异,还验证了两大应用场景,有深刻研究洞见。
AI能否「圣地巡礼」?多模态大模型全新评估基准VIR-Bench来了
来自日本高校和企业团队提出多模态大模型评估基准 VIR-Bench,用于评测 AI 对旅行视频中地理位置与时间顺序的理解。它将任务拆解,构建数据集,实验显示模型虽有改进但性能远未达标,指明了大模型进化方向。
库克虎口夺食:马斯克盯上的北大校友AI公司被苹果抢走
苹果和马斯克旗下公司争抢Prompt AI,苹果与该公司进入后期谈判,欲买走核心团队和技术资产。Prompt AI是2023年成立的CV初创公司,旗舰产品Seemour用于提升家用摄像头智能感知能力。
2025 年 InfoQ 趋势报告:AI、ML 和数据工程
InfoQ AI ML 趋势报告基于编辑团队与嘉宾播客,总结 AI、ML 技术发展趋势。涵盖 AI 代理、多模态语言模型等创新领域,也提及早期采用者、早期多数、晚期多数类别的技术,还对 2025 年相关领域发展作出预测。
知名机器人专家喊话:投人形机器人初创公司的数十亿美元,正在打水漂
知名机器人专家罗德尼・布鲁克斯质疑特斯拉、Figure等公司技术路线,称让机器人看人类视频学操作是‘空想’。他指出触觉数据无技术积累、安全有隐患,预测成功‘人形’机器人未来将大不同,投资难量产。
OVI:统一的音视频生成模型,声音与画面同步诞生
音视频生成领域以往多阶段架构易致音画不同步等问题。耶鲁大学团队提出 OVI 统一范式,采用双塔 DiT 架构与分块式跨模态融合机制,实现音画同步生成,不过目前有计算开销大、音频有局限等问题。
DeepSeek突然拥抱国产GPU语言!TileLang对标CUDA替代Triton,华为昇腾Day0官宣支持适配
DeepSeek v3.2开源TileLang版本算子引关注,其可对标CUDA替代Triton,还适配国产算力生态,华为昇腾官宣支持。TileLang由北大团队主导,提供不同层次编程接口,助DeepSeek提升性能。
对谈 Macaron 创始人陈锴杰:RL + Memory 让 Agent 成为用户专属的“哆啦 A 梦”|Best Minds
本文访谈 Macaron 创始人陈锴杰,探讨 RL+Memory 让 Agent 发展及 Macaron 产品。他强调 RL 在 Agent 开发重要性,介绍 Macaron 定位、特点、训练方式,还谈及社区设想、RL 应用及产品发展方向等。