「多语言处理」共找到 5417 篇相关文章
从 AI Agent、RLHF 到 MoE 大规模训练:AMD 这场开发者日,把一线实战话题凑齐了 |Q推荐
AMD AI开发者日揭晓八大硬核GPU Workshop、技术专题及“作品说话”主题分论坛嘉宾与话题,覆盖AI Agent、RLHF、MoE大规模训练等前沿领域,还有多场实操分享。
2025云栖大会即将开幕,InfoQ 和你一起深度打卡!
9月24 - 26日,2025云栖大会将在杭州开幕,主题为‘云智一体·碳硅共生’。大会展示Agentic AI和Physical AI突破,探讨多领域话题。InfoQ与大会深度合作,全程陪伴打卡。
开源音视频同步SOTA基座:极简的单流架构,2秒出片
AI视频生成迈入音视频同步新纪元,闭源巨头已展实力,而上海创智学院与Sand.ai联合发布的开源音视频生成基础模型daVinci - MagiHuman,以极简单流架构,2秒就能在1张H100显卡上生成精准音视频同步画面。
智谱 AutoClaw 深度测评:一键把电脑变成 AI Agent,是神器还是半成品?
本文深度测评智谱最新推出的桌面应用AutoClaw。它宣传能让电脑成AI Agent,引发两极评价。文章从安装、界面、功能、成本等方面测评,指出其优缺点,认为虽不完美但方向值得肯定。
姚顺宇谷歌首秀,Gemini新模型刷爆SOTA:人类仅剩7人捍卫碳基编程
面对Claude Opus 4.6和GPT Codex 5.3的攻势,谷歌升级Gemini 3 Deep Think,在多项基准测试刷爆SOTA,推理成本降低82%。它还走进科研工程领域,其研发团队有不少华人,如姚顺宇、Yi Tay。
不用拍的广告片?深度拆解美团闪购AIGC营销新案例
美团闪购与AI达人共创两支AIGC营销视频,以“技术为品牌说话”。“西游篇”突出“快”,“神话篇”展示“多”,用AI生成“超现实”场景包裹品牌价值,为行业提供营销示范。
30.9K Star牛啊!!再见了PD,不越狱也能装,支持几十种系统,苹果全设备通用!
在苹果生态运行其他系统,Parallels Desktop 收费且移动设备难装。开源工具 UTM 免费,基于 QEMU 构建,支持多架构和系统,操作界面简洁,外围设备支持强,苹果全设备通用。
面壁小钢炮 VoxCPM-TTS:开源端到端 TTS,轻量高效低延迟
面壁提出基于扩散自回归建模的端到端语音生成模型 VoxCPM,构建于 MiniCPM - 4 之上。它克服传统离散 token 方法缺陷,实现语义与声学特征解耦,有上下文感知语音生成和零样本语音克隆能力,低延迟。
字节Seedream 4.0将全量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法
近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持多模态生图,核心能力显著提升。它将全量上线并开放给企业客户。实测显示其多模态融合出色,还与谷歌 Nano Banana 对比,各有优势。
华南理工开源小智AI硬件后端服务,支持MCP。
华南理工大学刘思源教授团队研发开源后端服务项目 xiaozhi-esp32-server,基于人机共生智能理论,为 xiaozhi-esp32 硬件提供支持,采用多语言实现,支持 MCP 接入等功能,适配多配置方案。