多语言渲染」共找到 4875 篇相关文章

开源动态8

面壁小钢炮 VoxCPM-TTS:开源端到端 TTS,轻量高效低延迟

面壁提出基于扩散自回归建模的端到端语音生成模型 VoxCPM,构建于 MiniCPM - 4 之上。它克服传统离散 token 方法缺陷,实现语义与声学特征解耦,有上下文感知语音生成和零样本语音克隆能力,低延迟。

带你学AI
产品应用8

字节Seedream 4.0将全量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法

近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持模态生图,核心能力显著提升。它将全量上线并开放给企业客户。实测显示其模态融合出色,还与谷歌 Nano Banana 对比,各有优势。

机器之心
开源动态7

华南理工开源小智AI硬件后端服务,支持MCP。

华南理工大学刘思源教授团队研发开源后端服务项目 xiaozhi-esp32-server,基于人机共生智能理论,为 xiaozhi-esp32 硬件提供支持,采用语言实现,支持 MCP 接入等功能,适配配置方案。

开源AI项目落地
8

AI改变世界!微软发布700个真实AI Agent、Copilot应用案例

微软发布700个真实的Agent智能体、Microsoft Copilot应用案例,涵盖金融、医疗、科技等领域。如埃森哲构建智能体降低销售未清天数,ANS用其提高成交率等。

AIGC开放社区
产品应用8

登顶 Arena!MiniMax 最新 Speech-02 模型屠榜:超越OpenAI、ElevenLabs,人声相似度99%

近期TTS模型领域发展火热,众机构纷纷发力。MiniMax推出的Speech - 02模型登顶Arena榜单,在字错率和相似度等指标上表现出色,具备超拟人、个性化、样性特点,性价比高,还创新架构解决了现有痛点。

AI前线
新闻资讯7

V4或Code要来?刚刚,DeepSeek-V3.1-Terminus发布!

DeepSeek线上模型升级为DeepSeek-V3.1-Terminus,单从名字看像是V3终极版,或在筹备V4及Code模型。deepseek - chat和deepseek - reasoner完成升级,此次更新改进语言一致性,优化Agent能力。

PaperAgent
新闻资讯7

The Batch: 940 |Claude Mythos Preview 引发安全担忧

Anthropic为即将推出的Claude Mythos Preview采取特别预备措施,因其会带来网络安全风险。该模型能力强大,能发现众代码漏洞。Anthropic组建联盟增强防御,其表现也优于个知名模型。

DeeplearningAI
新闻资讯7

第一批“首席龙虾官”,月薪6万

当下不少公司热招“龙虾官”,涵盖AI、医疗、房地产等行业,薪资优厚。“首席龙虾官”负责推动公司AI Native转型,还有OpenClaw开发工程师等岗位,大模型、智能体技术正改变工作方式。

量子位
开源动态8

不看后悔!GitHub 开源 MultiTalk .8k star 强大的人语音+图像绑定项目

MultiTalk 是 MeiGen‑AI 开发的开源框架,可从音频、图片和提示语生成人对话视频。它解决传统视频制作痛点,功能亮点,技术优势明显,应用场景广,与同类项目对比表现突出。

小华同学ai
开源动态8

终于开源升级OmniGen2,统一模态图像生成模型,真的惊艳。

OmniGen2是强大的开源统一模态图像生成模型,针对文本和图像模态构建独立解码路径,运用未共享参数。新架构提升处理效率和质量,在图像编辑等任务表现出色,还有技术特点。

开源AI项目落地