等变建模」共找到 8364 篇相关文章

新闻资讯8

英伟达Jim Fan:「世界建模」是新一代预训练范式

英伟达机器人主管Jim Fan判断,继“下一个词预测”后,世界建模将成新预训练范式,2026年大世界模型将为多模态AI奠基。他还讨论世界模型定义、应用,展望新推理形式,业内人士也各抒己见。

量子位
产品应用8

AI 产业终于来了自己的“支付宝时刻”

本周支付宝发布面向 AI Agentic Commerce 的全栈支付解决方案。该方案含信任基座、收付引擎、AI 钱包助手和 Token Pay,解决支付安全、收付款及管控问题,推动 AI 产业从工具走向商业循环。

MacTalk
产品应用8

Spec 退场,skills 上位:Codex 团队的产品方法论

文章介绍了OpenAI Codex团队产品方法论的化,从重视spec转向skills,开发从“描述过程”转向“组织能力”。还谈及Codex app开发、团队协作,指出模型强后工作模式转,职业边界模糊,团队招人看重主动性。

InfoQ
开源动态7

MUSA获得SGLang主线支持!5月10日北京,AI Meetup你来

5月10日北京将举办「SGLang × MUSA」技术沙龙。契机是摩尔线程MUSA后端加入SGLang官方支持体系,代码合入主线,开发者可原生调用摩尔线程GPU。还将探讨框架适配、算子编译议题。

GiantPandaLLM
新闻资讯7

2025谷歌博士生奖学金揭晓,清华、科大、南大校友入选

本周四,谷歌公布2025年度博士奖学金入围名单,获奖者来自35个国家和地区、12个研究领域,共255名博士生。文章介绍了各领域的华人研究者情况,涉及算法、架构、人机交互多个方向。

机器之心
算法论文7

复旦推出「第一人称视听基准」,补齐多模态模型「听觉拼图」

多模态大模型在真实世界会“失聪”,现有第一人称视频问答/理解基准长期偏“视觉中心”。复旦团队推出首个系统评测第一人称声音理解能力的基准EgoSound,能让模型听懂世界,评测显示当前模型与人类差距大。

量子位
新闻资讯8

ICCV 2025最佳论文出炉!何恺明、孙剑十年经典之作夺奖

ICCV 2025公布奖项,CMU团队凭BrickGPT获最佳论文,以色列理工学院团队FlowEdit获最佳学生论文。何恺明十年前论文获Helmholtz Prize。大会规模超往届,投稿11239篇,录用2500 + ,超半作者来自中国。

新智元
新闻资讯8

刚刚,清华黄高、北大刘譞哲入选2026科学探索奖

2026年「科学探索奖」获奖名单揭晓,50位青年科学家入选,覆盖10个领域。其中信息电子领域5人,包括清华黄高、北大刘譞哲,他们研究方向多元,成果显著,对AI发展意义重大。

机器之心
算法论文8

让大模型“吃一堑长一智”,南理工百度提出模型记忆新方法

南京理工大学联合百度提出新方法ViLoMem,构建视觉流+逻辑流的双流语义记忆,让模型“从错误中学习”。它能在多模态基准提升模型表现,强模型记忆还可迁移给小模型。

量子位
算法论文8

何恺明降维打击!彻底颠覆AI生图,无需预训练一步到位

何恺明团队推出生成模型MeanFlow,它跳脱传统训练范式,无需预训练,仅一次函数评估就能完成生成。在ImageNet 256×256上表现优越,缩小了一步与多步模型性能差距。

新智元