多尺度生成」共找到 5656 篇相关文章

新闻资讯7

Devin CEO:别搞智能体!Anthropic:我们性能提升90%!

最近,开发Devin的Cognition CEO发文称不要构建智能体系统,而Anthropic分享构建智能体研究系统,性能提升90%。Cognition认为智能体协同难,坚持单线程线性Agent;Anthropic用工程设计绕开瓶颈。二者因任务类型不同观点有别。

探索AGI
开源动态8

轻量级开源AI智能体框架!智能路由+上下文管理,前后端接口支持!

随着智能体系统成对话式AI新趋势,GitHub现轻量级高灵活性AI智能体协调框架Agent - Squad,它能实现智能体协作、路由和上下文共享,支持双语言,部署灵活,功能强大且安装友好。

开源星探
开源动态8

近5w颗星!一个能同时指挥个AI写代码的开源工具来了

现在写代码,很人想开个AI助手。Orca是支持AI Agent的编程开发环境,各Agent在独立git worktree里运行,互不干扰。它功能丰富,还支持系统安装。

GitHubStore
开源动态8

数字人视频革命!MultiTalk开源:15秒人对话一键生成,歌唱/卡通全驾驭!

在AI驱动的视频生成领域,创建人对话场景是难题。MultiTalk是开源音频驱动人对话视频生成框架,由MeiGen - AI等联合研发,输入路音频等就能生成嘴型同步的视频,适用于种场景。

开源星探
产品应用7

不要再拖拉拽了,利用n8n mcp直接生成n8n工作流

n8n是国外热门的AI应用编排工具,但用好它生成工作流并不容易。现介绍能生成n8n工作流的mcp,简单配置即可让AI生成工作流,其地址为https://github.com/czlonkowski/n8n - mcp。

AI工程化
新闻资讯7

CVPR 2025 Tutorial:从视频生成到世界模型 | MMLab@NTU团队&快手可灵等联合呈现

图像生成普及,视频生成也有高质量发展,可灵、Sora等模型不断拓宽边界。CVPR 2025 Tutorial将探讨视频生成能否成世界模型桥梁、具身智能核心能力等问题,汇聚一线研究者分享。

量子位
推荐文章8

企业级 Agent 智能体架构与选型指南 -- 来自1000+行业应用实践积累

本文基于超1000+智能体应用实践经验,介绍企业级Agent智能体架构。强调单智能体优先,介绍AgentScope支持的智能体模式,对比工作流与对话模式,给出架构选型指南,还提及Spring AI Alibaba Graph为智能体提供的能力。

阿里云开发者
算法论文8

别再用单选评测骗自己了!Amazon新论文揭示了大模型在选题中的3种系统性偏差

Amazon新论文揭示大模型做选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型选题正确率。

深度学习自然语言处理
算法论文8

天下苦VAE久矣:阿里高德提出像素空间生成模型训练范式, 彻底告别VAE依赖

当前主流图像生成技术训练范式依赖VAE,带来训练复杂、微调成本高的问题。阿里高德提出EPG,结合自监督预训练与端到端微调,去除对VAE依赖,在训练效率和生成效果上有突破。

量子位
产品应用7

AI 视频生成“试金石”:谷歌 Veo 3 体操“图灵测试”未达标,仍是“抽象派”!

谷歌新出的Veo 3视频生成模型画质惊艳且能开口说话,但生成体操动作效果差,像“抽象派”。虽存在生成不准问题,但物理效果比其他模型好。有人建议其与专业动捕公司合作,音画一体或成视频模型竞赛标配。

AI进修生