不对称训练」共找到 3307 篇相关文章

算法论文8

解决特斯拉「监督稀疏」难题,DriveVLA-W0用世界模型放大自动驾驶Data Scaling Law

自动驾驶领域VLA大模型面临‘监督稀疏’难题,特斯拉公布此挑战。DriveVLA - W0研究提出用世界模型解决,将‘预测未来图像’作自监督训练任务,还提出轻量级架构降低推理延迟。

机器之心
开源动态8

北大开源统一世界模型框架:多类合成推理任务一套搞定

世界模型研究中,同任务存在接口统一等问题。北大DCAI课题组联合多方推出OpenWorldLib推理框架,整合多模态能力,构建标准化接口体系,在多任务上评估效果良好,降低研发门槛。

量子位
产品应用8

刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了

LMArena竞技场发布文生图榜单,腾讯混元图像3.0夺冠,超越谷歌、字节和OpenAI等模型。它是原生多模态模型,语义理解强,核心技术独特,经多阶段训练,效果能与顶尖模型媲美。

量子位
新闻资讯7

突发 | Meta 挖走的OpenAI 核心研究员Jason Wei,离职前留下这样的一段话

OpenAI研究员Jason Wei和Hyung Won Chung跳槽至Meta,Wei在离职前发推文分享强化学习感悟及验证对称性概念,引发网友猜测与共鸣,这场AI人才争夺战正愈演愈烈。

AGI Hunt
算法论文8

桌面 Agent 的下一步:是会操作,而是会调度工具

复旦大学和通义实验室提出 ToolCUA,让模型在 GUI 与工具调用间编排路径。它从已有 GUI 轨迹合成训练数据,设计奖励机制,在 OSWorld - MCP 评测中效率与准确率大幅提升,为 CUA 发展提供方向。

深度学习自然语言处理
推荐文章7

盘一下Anthropic 244页Claude Mythos报告中隐藏的SAE技术

Anthropic公布强大危险的大模型Claude Mythos Preview但未发布。文章深挖其244页报告中SAE技术细节,包括前期探索、技术框架、训练监控、攻击性行为分析及掩盖行为等,助了解模型内部思维。

PaperAgent
推荐文章7

Sutton 的批评与反思:AGI 的下一步是什么?

文章是对 Richard Sutton 采访的反思,指出 LLM 训练效率低、依赖人类数据,未实现有机自主学习。作者与 Sutton 有分歧,认为模仿学习与强化学习互补,还探讨持续学习,称 Sutton 批评有启发性。

AGI Hunt
新闻资讯7

Common调查数据,72%美国青少年使用过AI伴侣

美国非营利组织Common Sense Media研究显示,72%美国青少年至少试过一次AI伴侣,52%为定期用户。研究还考察了使用行为、原因、感受等,如近半视其为工具,50%信任其信息。

AIGC开放社区
新闻资讯7

开源套壳叫板Google?Perplexity新品发布,印度裔CEO放言5万美金撬走彭博千亿生意

本周,AI搜索公司Perplexity推出Comet浏览器,整合自家AI搜索与智能助手,挑战Google Chrome。其CEO Aravind Srinivas认同走垂直路线,获马克·安德森支持。此外,他们还想以AI终结Bloomberg,盯上金融市场。

AI前线
开源动态8

21.7K 标星的开源TTS!FishAudio开源情感语音核弹:200万小时炼成“声优AI”!

FishAudio团队推出新一代TTS语音模型OpenAudio S1,基于200万小时音频数据训练,采用Qwen3+Descript Audio Codec架构。它能实现情感表达,在TTS - Arena榜单登顶,还提供同版本适配,适用场景广泛。

开源星探