「团队聚焦」共找到 3996 篇相关文章
AI 驱动的智能异常处置:从异常发现到根因定位
在 2025 年 QCon 全球软件开发大会(北京站)上,阿里云算法专家张颖莹分享《AI 驱动的智能异常处置:从异常发现到根因定位》。她介绍阿里云计算平台运维挑战,给出算法选型与设计思路,还提及后续平台建设规划。
TPAMI | DC-SAM:打破SAM交互限制,基于循环一致性的图像与视频上下文分割方法
北京邮电大学联合南洋理工大学等机构发表论文,提出 DC - SAM 框架及 IC - VOS 基准。DC - SAM 含特征融合、正负双分支循环一致性提示生成等部分,实验在多基准测试获 SOTA 性能,为视觉大模型落地提供方案。
实测丨别人还在做网站,Atoms 已经帮用户赚到第一桶美金了
当下多数AI编程工具只解决写代码问题,难以让产品变现。Atoms由MetaGPT等原班人马打造,补齐商业闭环,从市场验证、上线收钱到解决流量问题都有办法,实测效果佳,还让普通人成功盈利。
从组件到 OS 的跃迁,MemOS 深度拆解:构建企业级 Agent 的高性能记忆底座【上】
本文深入剖析开源记忆方案MemOS,它将记忆从“外挂组件”升为“系统资源”。介绍其设计理念、核心架构,分析记忆需加工、分层调度和治理的原因,还阐述记忆三态及流转,最后展示MemOS Cloud的使用方法。
告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent
现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。
良心老黄不搞硅谷资本家那套!Groq人均套现500万美元
英伟达200亿美元收购「TPU之父」创业公司Groq,老黄给股东分红,90%团队被打包带走,人均到手500万美元。收购规避反垄断审查,还解锁新方案LPU,有望打造全栈方案。
拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?
现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。
一等奖20万,大佬们出题,最硬核视频生成全球挑战赛开启!
首个AI视频生成全球挑战赛来袭,多位大佬发起,20万大奖待拿。大赛聚焦AI视频生成「一致性」挑战,设主赛道和创意赛道,分别面向技术派和创作者,旨在推动视频生成技术发展。
AI生成内容行标来了!工信部立项管理,欢迎参与起草
据工信部通知,清华大学牵头的《元宇宙 共性服务 数字内容管理要求》行业标准获批立项并征集起草单位与专家。此为全国首部聚焦元宇宙数字内容标准,覆盖多环节,助力产业健康发展。
浙大联手字节:开源大规模指令跟随视频编辑数据集OpenVE-3M
浙江大学与字节跳动合作,提出大规模指令跟随视频编辑数据集 OpenVE-3M,有 3M 样本对。还提出数据构造管线、编辑模型 OpenVE-Edit 及评测集 OpenVE-Bench,小参数量下超越现有开源模型。