「高质量训练数据」共找到 4336 篇相关文章
全员本科生!何恺明组新作:文生图,258M参数就够了
何恺明携本科生团队推出文生图模型MiniT2I,基于MM - JiT架构,仅用258M参数实现不错效果,训练成本低。该架构删繁就简,去掉VAE和AdaLN等模块,性能提升,展现出与工业级模型的竞争力。
AI创业一年狂揽800亿美元!Anthropic反杀OpenAI,双雄独吞89%
The Information数据显示,34家头部AI创业公司年化收入达800亿美元,OpenAI和Anthropic拿走89%。Anthropic反超OpenAI,靠企业客户崛起。剩下32家分11%份额,AI产业链价值向模型厂回流。
从「片段生成」到「长视频漫游」:OmniRoam探索轨迹可控的长视频生成新范式
在生成式视频发展中,长时序视频生成面临挑战。研究者提出 OmniRoam 新方法,通过全景表示和分阶段生成框架,提升视频时空一致性,还构建数据评测体系,实验表现优,有效率和 3D 应用潜力。
统一VLA范式!港科大开源StarVLA乐高式架构,复现成本大幅降低
当前具身智能的VLA赛道陷入「碎片化」泥潭,方法难对比、复现成本高。港科大开源StarVLA,提出「乐高式」统一架构,构建模块化开源底座,实现双向模块化,还支持多种训练范式,打通Sim2Real。
Anthropic宣布练出神话级模型:Claude Mythos,代码和黑客能力吊打opus4.6,不向公众开放!
Anthropic宣布Project Glasswing计划,因训练出超强模型Claude Mythos Preview。该模型代码和推理能力超opus 4.6,扫描主流软件发现数千零日漏洞。此模型不向公众开放,计划先在Claude Opus验证安全机制。
前谷歌研究员发文:算力崇拜时代该结束了
前谷歌大脑研究员 Sara Hooker 发文指出,过去十年 AI 创新依赖算力,但如今持续扩展训练计算资源效率极低,收益递减。她探讨了影响算力回报率的因素,批判 Scaling Law,并提出未来创新方向。
OpenAI 又整大活:发布首款 AI 浏览器 Atlas,目前仅限 macOS
OpenAI发布首款AI浏览器Atlas,仅限macOS。它集成原生ChatGPT,功能强大,是传统浏览器及AI浏览器新贵的竞争对手,完成度高。其让ChatGPT能读取网页数据、执行动作,或成未来AI操作系统接口。
CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning
大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。
“零人”搞医学研究:清华AI智能体从灵感到论文全程自主
清华大学自动化系索津莉课题组发布全自主AI研究框架OpenLens AI,实现医学研究全链条自动化闭环,解决医疗信息学研究效率困局,将科研周期从“月级”缩至“小时级”,还在质量控制上设新标杆。
Isomorphic Labs:DeepMind 创始人再创业,打造制药界的 TSMC
Isomorphic Labs 由 Alphabet 拆分 DeepMind 生命科学团队而来,用深度学习加速药物设计。借 AlphaFold 3 将药物发现转向 AI 驱动,与药企合作获数据和收入,有望成药物研发‘AI Foundry’,但也面临挑战。