多尺度生成」共找到 5668 篇相关文章

开源动态8

openJiuwen社区首发「Coordination Enginnering」,让智能体从「单兵作战」到「精锐团队」

openJiuwen社区围绕Coordination Engineering发布智能体协同技术体系,包括Agent Team、Team Skills等。该体系解决智能体协作问题,实现团队自主协作、经验沉淀与进化,还提供相关工具和平台。

机器之心
开源动态8

AI自己写代码做科研还跑赢了前沿算法?清华团队开源Alchemy框架

清华团队开源 Alchemy 框架,它是面向自动化 AI 科研的标准化研究环境,能让 AI Scientist 摆脱工程负担,专注算法创新,还支持领域、任务,具有种特性,在模态推荐任务中表现出色。

机器之心
产品应用8

AgentScope x RocketMQ:打造企业级高可靠 A2A 智能体通信基座

文章介绍 Apache RocketMQ 新推的 LiteTopic 通信模型,能简化 AI 系统架构、提升稳定性。结合 A2A 协议与 AgentScope 框架案例,剖析智能体通信实践与技术实现,还给出构建智能体应用的实战方案。

阿里云开发者
开源动态8

Sora2还在5秒打转,字节AI生视频已经4分钟“起飞”

字节和UCLA联合提出Self - Forcing++方法,无需更换模型架构或重收集数据集,就能生成分钟级长视频,最长达4分15秒,高质量且开源,在长、短时长生成上性能领先。

量子位
产品应用7

SkyReels-Audio让嘴型和音频完美匹配不再难

音频驱动的动态人脸生成研究较少,昆仑万维提出SkyReels - Audio框架,基于预训练视频扩散变换器构建,支持无限长度视频生成与编辑,采用混合课程学习等策略,保障视频视觉保真度和时间一致性。

带你学AI
算法论文8

转载 | 赖姜研究员等:基于人工智能的结构力学专题序

基于人工智能的结构力学研究因领域融合取得进展,突破传统瓶颈。《力学学报》组织专题含6篇论文,展示我国科研人员在该领域结合的最新成果,位专家参与,介绍了专题相关研究及期刊信息。

力学与人工智能
算法论文8

12毫秒暴露自动驾驶致命缺陷,北航新研究实现场景感知的动态物理对抗攻击|TPAMI2025

近日部分L3级自动驾驶车型获批上路,但自动驾驶感知系统存在缺陷。北航等机构提出DynamicPAE框架,实现场景感知的动态物理对抗攻击,解决维度挑战,在场景表现优异,被TPAMI2025录用。

量子位
开源动态8

新型开源端到端 AI 语音模型!Voila:195ms 超低延迟引领全双工对话!

Maitrix团队发布开源AI端到端语音模型Voila,以195ms超低延迟及全双工对话受关注。它功能强大,支持语言,有种使用方式,适用于个场景,架构采用模块化设计。

开源星探
新闻资讯7

米哈游蔡浩宇AI公司首个视频模型曝光了

米哈游蔡浩宇的AI公司Anuttacon首个视频模型LPM 1.0曝光。它可通过模态形式生成动态角色,有超绝情绪演绎、实时视频生成等能力,背后技术架构复杂,目前未正式上线。

量子位
开源动态8

开源AI引爆热潮!GOSIM AI Paris 2025首日直击:80+位技术大咖聊模型、拼算力、秀落地

5月6日,GOSIM AI Paris 2025大会在法国巴黎启幕,80余位技术专家与学者参会。GOSIM联合创始人认为开源AI已追上闭源,AGI或由模型组成网络。大会设四大分论坛解析开源AI,还有特色单元,明日将迎PyTorch Day。

AI科技大本营