构建和部署」共找到 8360 篇相关文章

产品应用7

SkyReels-Audio让嘴型音频完美匹配不再难

音频驱动的动态人脸生成研究较少,昆仑万维提出SkyReels - Audio框架,基于预训练视频扩散变换器构建,支持无限长度视频生成与编辑,采用混合课程学习等策略,保障视频视觉保真度时间一致性。

带你学AI
开源动态7

315 行代码构建编程助手,Go大佬揭开智能体的「神秘面纱」

知名Go大佬Thorsten Ball用315行代码构建编程智能体,虽无法与Claude、Gemini等编码功能媲美,但为初学者提供学习范例。文章分享构建步骤,包括准备工作、添加工具等,展示如何让智能体与Claude对话及使用工具。

机器之心
开源动态7

MCP实战|从0到1构建异步 DeepResearch 工具,支持进度推送与超时控制

本文借助开源项目,构建可在MCP Server中异步运行的DeepResearch,支持任务进度推送与超时控制。介绍项目架构、构建步骤、任务管理器实现要点及效果测试,还提及优化方向并给出源码。

AI大模型应用实践
算法论文8

RAE的终极形态?北大&阿里提出UniLIP: 将CLIP拓展到重建、生成编辑

北大阿里团队提出 UniLIP,解决了统一多模态模型中语义理解与像素重建的矛盾。它创新微调 CLIP,实现图像重建,还提出双条件架构用于生成编辑,在多基准取得 SOTA 性能。

机器之心
算法论文8

攻克「恶意投毒」攻击!华南理工联合霍普金斯UCSD,连登TPAMI、TIFS顶刊

华南理工大学计算机学院AI安全团队联合国际高校,聚焦联邦学习中防范恶意投毒攻击。提出FedIDScope两种创新防御方法,前者用多种度量标准动态加权检测恶意梯度,后者通过逐维归一化等揭示后门维度,均有良好效果。

新智元
算法论文8

超越Claude MythosGPT-5.5!斯坦福Agent验证框架拿下SOTA,Transformer作者转发

斯坦福、伯克利与英伟达联手打造LLM-as-a-Verifier验证框架,该方法是通用验证机制,可与任意Agent Harness模型结合。研究表明扩展验证阶段计算量,能提升Agent整体性能,在多基准测试中超越Claude MythosGPT - 5.5。

量子位
新闻资讯7

目标出货一亿台,AltmanIve的新公司「io」到底要做什么硬件?

本周三,OpenAI收购AI硬件创企「io」,引发对合作细节硬件产品的猜测。Sam AltmanJony Ive计划打造非手机、眼镜的设备,成第三核心小工具,计划出货1亿台,目标明年年底推出。

Founder Park
算法论文8

ICCV 2025 | 小红书AIGC团队提出图像视频换脸新算法DynamicFace

小红书AIGC团队提出图像视频换脸新算法DynamicFace。该算法创新性融合扩散模型与3D人脸先验,解耦身份与运动信息,设计双流注入架构时序一致性模块,实验证明其在身份保真与运动还原上优势明显。

机器之心
产品应用8

刚刚,千问App把谷歌OpenAI的「付费绝活」塞进了手机,还免费?

千问App迎来史诗级更新,接入阿里两大视觉模型Qwen - ImageWan 2.5。Qwen - Image在图像编辑上有强大视觉逻辑理解一致性保持能力;Wan 2.5能实现原生音画同步。千问App还实现一站式工作流。

机器之心
推荐文章8

构建 AI 时代的知识底座:直播数据 LLM Wiki 实践

文章围绕直播数据 LLM Wiki 实践展开,指出领域知识沉淀面临挑战,引出 LLM Wiki。介绍其实际效果,如指标召回、代码生成等,阐述构建方法、架构设计、编译流水线、检索方式,还提及增量编译与持续 Lint,最后给出未来规划。

阿里云开发者