「DiT4DiT模型」共找到 8436 篇相关文章
Claude Mythos Preview来了!强大又危险,Anthropic还专门组了个研究团
今日凌晨,Anthropic发布Claude Mythos Preview新模型及AI网络安全项目Project Glasswing。该模型虽性能卓越,但有安全风险,Anthropic暂不全面开放。Project Glasswing汇聚众多巨头,获巨额资金支持,旨在构建AI防御联盟。
Hugging Face 推出九大 AI 课程,免费、全面【收藏】
Hugging Face悄悄上线一批免费AI课程,还带认证证书。课程从大语言模型到扩散模型,从计算机视觉到游戏AI,覆盖面广。完成课程可拿证书,还能在平台分享成果,是学习AI的好机会。
ICML 2025杰出论文出炉:8篇获奖,南大研究者榜上有名
本周一,ICML 2025公布最佳论文奖项,共8篇获奖,含6篇杰出论文奖、2篇杰出立场论文奖,南京大学研究者上榜。大会投稿量持续增长,展示AI领域火热。文中介绍了各获奖论文的研究内容与成果。
刚刚,全球最强GPT-6 Astra来了!人类进入AGI时代
OpenAI官宣下一代旗舰模型GPT - 6 Astra,定义其为「世界上最智能、对齐程度最高」的模型。它多项基准测试成绩惊人,在编程、计算机使用等多领域表现卓越,还改写科研纪录,不过因安全能力强暂未全开放。
00后的他们,正在定义AI时代的新坐标丨红杉中国联合《麻省理工科技评论》中国发布“25岁以下AI创新青年先锋”
AI领域创新正由年轻一代推动。红杉中国与《麻省理工科技评论》中国发起“AI25”计划,揭晓2025年“25岁以下AI创新青年先锋”入选者名单,他们在各领域成果突出,未来还将打造AI原生社区。
LLM 仅靠自身就能增强推理?SePT 给出简洁在线自训练范式
多数推理后训练方法依赖外部信号,SePT仅用模型自身生成的答案自训练,能提升推理能力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用能力,代码易迁移复现。
Google悄悄下了一盘大棋:一天三个端侧AI项目同时爆发
Google 一天内三个端侧 AI 项目爆发,包括离线听写 App Eloquent、端侧 AI 示例集 AI Edge Gallery 和端侧大模型推理运行时 LiteRT-LM。云端大模型竞争趋同,端侧 AI 是差异化战场,Google 全栈布局有优势。
代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈
ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。
阿里干死豆包图疯传,千问:相煎何太急;字节大幅涨薪,传年利润或达500亿刀;印度AI妖股近两年暴涨550倍,仅2名员工|AI周报
这篇 AI 周报涵盖多领域动态。如阿里辟谣千问全员会干死豆包图;周鸿祎遭前高管实名举报财务造假;字节涨薪并推进 AI 手机合作;多家科技公司有新品发布或业务进展等。
逼近5万亿美元!英伟达GTC深夜爆拉市值,Vera Rubin超级芯片首露面
昨夜英伟达GTC大会上,黄仁勋演讲后股价涨4.98%,市值增2300多亿美元达4.89万亿逼近5万亿。他介绍了Vera Rubin超级芯片等,还宣布多项技术成果,如AI原生6G协议栈、NVQLink等。