「L3阶段」共找到 2702 篇相关文章
每一幕皆可控!字节发布多主体视频生成神器,人人皆主角
字节发布多主体视频生成神器MAGREF,基于一张参考图像,能生成主体高度一致的视频,多人同台也不串脸。它采用三阶段数据处理流程,构建在DiT架构上,实现复杂视频生成任务。
刚刚,Gemini 2.5 Pro升级,成编程模型新王
Google DeepMind发布Gemini 2.5 Pro (I/O edition),编程能力大幅提升,在编程排行榜超Claude 3.7 Sonnet。用户用一个提示词或草图+描述就能构建应用,谷歌大佬站台,网友实测效果佳。
两个「最强AI」塞进Xcode!苹果这波杀疯了
苹果发布Xcode 26.3重磅更新,将Codex和Claude接入IDE,引入新框架和MCP开放标准。这影响万亿级市场,获开发者好评,是苹果AI战略成熟标志,放下身段提升开发效率。
端到端GUI智能体首次实现“犯错-反思-修正”闭环,模拟人类认知全过程
南洋理工大学MMLab团队提出框架GUI - Reflection,让端到端多模态GUI智能体有“自我反思”能力。它在各训练阶段引入“反思与纠错”机制,实验证明该框架能提升智能体能力。
“无限可能”AI视频竞演第二阶段结果揭晓,11部作品入围深圳路演大会
3月8日,“无限可能”AI视频竞演完成二阶段评审,11部作品从50部入围作品中选出,晋级3月14日深圳路演大会。作品经“幻镜”AI视听测评季第三季测评,结果将现场公布。
测试时也能RL,英伟达等提出全新范式:TTT-Discover
近日,斯坦福、英伟达、Together AI 等联合开源全新测试时新范式 TTT - Discover,在测试阶段用强化学习微调模型,以刷出 single best 结果,用几百美元就刷新诸多领域 SOTA。
端午出游高定:通义灵码+高德 MCP 10 分钟定制出游攻略
文章介绍端午用通义灵码+高德MCP 2.0定制北京3天旅行攻略,包括利用已有MCP服务定制攻略的步骤,还讲述打造专属MCP服务的方法,最后给出自由探索方向。
Meta打碎Transformer 8年铁律!改写AI最底层规则,模型首次冒出潜意识
Meta推出「自由Transformer」新模型,打破自2017年以来GPT模型核心规则,在解码器引入潜在随机变量Z,增加“潜意识”。仅增约3%计算开销,在多测试中超越大规模模型,或开启后自回归时代。
重磅!Telegram官宣Grok将登陆!Ton应声暴涨16%
Telegram创始人宣布与xAI达成1年合作,将Grok AI集成到应用中,今年夏天用户可使用。Telegram获3亿现金加股权及50%订阅分成,此合作改写聊天应用格局,也引发用户不同反应。
Google I/O 2026 | 开发者主题演讲精华集锦
在今年 Google I/O 大会上,谷歌发布 Gemini 3.5 系列模型,升级 '智能体优先' 开发平台 Antigravity,展示新工具和技能,助力开发者构建应用,还介绍了多项新技术及功能,另有招募活动。