图像和视频换脸」共找到 7601 篇相关文章

新闻资讯7

DeepMind老兵,正在离开伦敦

据Bloomberg报道,顶尖AI研究员Jonas AdlerAlexander Pritzel计划离开Google加入Anthropic,他们是Gemini模型重要贡献者。此外,Google DeepMind数位重量级人物也相继离职,反映出Google在人才竞争上的尴尬。

机器之心
算法论文8

AI 如何讲好一个多人故事?首个支持多角色互动的3D场景叙事系统

首尔国立大学提出全新框架,能生成虚拟动态场景并支持多角色上下文动作生成。引入LLM拆解复杂任务,系统用事件驱动方式规划动作,还构建基准评估相关能力,有良好扩展性实用性。

带你学AI
开源动态7

250美元起售,还开源,Hugging Face 发布史上最亲民人形机器人

Hugging Face 开源两款人形机器人 HopeJR Reachy Mini,前者全尺寸有 66 个驱动自由度,售价约 3000 美元;后者成本低至 250 美元,可用于测试 AI 应用。虽被指外观不佳,但推动开源机器人生态发展。

机器之心
开源动态8

多智能体编排太繁琐?MASFactory用Vibe Graphing直接「话」出来了

多智能体系统编排当前较为繁琐,北京邮电大学开源 MASFactory 框架,提出以图为中心架构 Vibe Graphing 开发范式,将开发推向自然语言驱动时代,系统评估显示其效果良好。

PaperAgent
开源动态8

工程师狂喜!Qwen3-VL 检索双雄效率翻倍

通义大模型开源Qwen3-VL-EmbeddingQwen3-VL-Reranker,解决多模态检索难题。两模型多模态全兼容,双塔+单塔协同提速,实用主义拉满,集成成本低,实战表现超预期。

CourseAI
开源动态8

告别单兵作战!这个Python语言驱动的AI智能体集群框架火了,30+工具一键调用!

团队开源了Python语言驱动的AI Agents开发框架Strands Agents Tools,提供30+预构建工具,支持多场景,降低开发门槛,为复杂任务调度系统调用提供解决方案。

开源星探
算法论文8

用MoE打造DNA基础模型更强范式!人大实现seq2func全新突破

中国人民大学团队提出SPACE模型,通过引入物种感知编码器谱系分组增强解码器,革新架构,提升了DNA基础模型性能与泛化能力,在多项测试中表现优于主流模型。

新智元
新闻资讯7

英伟达机器人掌门人Jim Fan年度复盘:Vibe Coding火出圈,机器人领域却依然焦头烂额

AK推文让Vibe Coding火出圈,而英伟达机器人负责人Jim Fan对2025机器人领域发展泼冷水,指出硬件可靠性差、Benchmark混乱、VLA路线存问题等现状,并分享3个教训,还回应网友质疑。

AI寒武纪
算法论文8

首篇WebAgents综述:大模型赋能AI Agent,实现下一代Web自动化

互联网任务重复繁琐,香港理工大学研究人员从架构、训练可信性等角度,总结WebAgents代表性方法,梳理研究进展。WebAgents能根据用户指令完成网页任务,其发展预示人机关系新纪元。

新智元
新闻资讯7

Anthropic 推出 MCP 隧道,供私有代理访问内部系统

Anthropic扩展Claude Managed Agents平台,推出自托管沙箱MCP隧道功能。自托管沙箱公测,支持多服务商运行工具;MCP隧道处研究预览,可让代理连私有MCP服务器,满足企业管控需求。

InfoQ