「高可用机制」共找到 2802 篇相关文章
谷歌Nano Banana全网刷屏,起底背后团队
谷歌开发者节目展示了Gemini 2.5 Flash Image模型,它能快速生成高质量图像、保持场景一致。文中起底背后团队成员,还介绍模型技术亮点、与Imagen对比及未来能力展望。
AI 编码圈新卷王 Magic Path 来了,Claude Engineer 团队出品,号称UI设计的 Cursor 时刻。
Magic Path是Claude Engineer团队推出的AI驱动UI设计工具,非开源但有免费额度。它AI先行,能按提示词生成组件和React代码,亮点诸多,上手体验佳,生成UI可用,还有页面串联等功能,虽有不足但潜力大。
夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26
在复杂视觉场景中,传统RGB - IR多模态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。
NUS&复旦&清华:首个系统性大模型Latent Space综述
新加坡国立大学等多机构发布大模型潜在空间领域首个系统性全景综述,从“基础—演进—机制—能力—展望”拆解潜空间范式的底层逻辑、技术路径与未来前景,还对比了潜空间与显式空间差异。
Agent框架各自为战?谷歌&微软:用Agent-KB让经验自由流动
当前不同框架的Agent知识无法互通,谷歌、耶鲁、字节、oppo等团队联合提出Agent KB,这是通用记忆基础设施,能让异构Agent框架共享经验。它有师生双阶段检索机制,实验验证其能带来显著增益。
Cursor也挖人了:Claude Code开发主管和产品经理被一锅端
编程神器Cursor母公司Anysphere挖到合作伙伴Anthropic两名前核心高管,原Claude Code开发负责人和产品经理将分别任Cursor首席架构师和产品负责人。这或使两家合作关系微妙,AI编程领域竞争激烈。
全新开源视频换装框架MagicTryOn
现有视频虚拟试穿(VVT)方法在时空一致性和服装内容保留方面有挑战,浙大提出全新开源视频换装框架MagicTryOn,利用全自注意力机制统一时空建模,设计服装保留策略,还引入掩码感知损失。
直播预约 | Transformer 模型能否通过连接训练数据中的离散知识进行推理?
为研究Transformer是否具备组合式推理能力,提出FTCT合成任务。实验发现Few - shot CoT提示可激发推理能力,训练与测试相似度、模型复杂度影响推理能力。还分析了其内在机制,展示其泛化推理潜力。
研究者尝试揭示扩散模型创造力的起源
斯坦福大学研究人员 Mason Kamb 与 Surya Ganguli 在论文中提出解释扩散模型创造力的机制,指出其创造力是去噪生成图像时的确定性结果,还识别出关键偏置,搭建 ELS 机模型并验证其准确性。
Meta首个Agent生图模型登场,空降竞技场第二
Meta超智能实验室推出图像生成模型Muse Image,引入智能体机制,能编写代码、网络搜索,有自主修正能力,支持算力扩展、多轮编辑与画面合成。还预览了Muse Video,两模型均与Meta产品深度整合。