「代码场景」共找到 3414 篇相关文章
从BM25到Multi-Vector:6种Embedding演进路线
文章介绍从BM25到Multi - Vector的6种Embedding演进路线,涵盖Sparse、Dense等类型,分析其痛点、效果、案例及选型建议,还给出不同场景的方案选择和步骤。
1.9K Star 微软开源TTS王炸!90分钟超长语音合成,4人对话自然切换!
在文本转语音(TTS)领域,生成长篇、多说话人的高质量音频一直是技术挑战。微软最新开源的VibeVoice TTS模型,可一次生成90分钟连续语音,支持4个不同说话人,还具备高效处理长序列等亮点特性。
OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式
现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。
使用 Claude Code 自动化 GitHub Actions
这篇技术博客介绍用Claude Code自动化GitHub Actions Runner镜像更新工作,包括用其处理补丁冲突、分析变更,以减少人工工作量,提升开发者生产力,还给出实现细节与代码。
含全文!OpenAI发布GPT-5官方Prompt指南
OpenAI 发布《GPT-5 prompting guide》,介绍新模型变化及使用方法。新增 `reasoning_effort` 和 `verbosity` 参数,还有 Responses API。Cursor 分享实战心得,同时提及控制 Agent 积极性、解决指令冲突等内容。
刚刚,Claude Code推出自动安全审查功能,顺便干掉了10家安全创业
Claude Code推出自动化安全审查功能,有 `/security-review` 命令和GitHub Actions集成两大核心能力,能检测多种漏洞,与传统SAST工具比优势明显,还能解释问题并提供修复建议。
刚刚,Anthropic切断OpenAI对Claude的访问权限
Anthropic周二切断OpenAI对Claude模型的API访问权限,因OpenAI技术人员通过API大规模用Claude Code写代码,违反服务条款。Anthropic曾有类似操作,网友对此事看法不一。
模型压缩与量化:让大模型走向轻量化落地
文章介绍模型压缩与量化技术,其能在保持性能时降低大模型计算和存储需求,实现边缘设备高效部署。还阐述基础知识、关键技术路径、应用场景,并探讨未来发展方向。
OmniAvatar震撼开源!阿里夸克开源全新音频驱动角色模型
音频驱动人体动画技术有局限,阿里夸克团队推出OmniAvatar模型。它用逐像素多层次音频嵌入和LoRA训练法,解决唇动同步等问题,适用于多领域,但也存在颜色偏移等不足。
Labubu换装记!让视频换装变得如此简单!基于扩散Transformer的视频虚拟试衣新突破
今天介绍开源项目MagicTryOn,它是基于大规模视频扩散Transformer的视频虚拟试衣框架,能实现高质量视频换装。采用三项关键技术创新,支持图像、视频试衣及定制化方案,目前仍在积极开发。