实时同传」共找到 548 篇相关文章

产品应用7

AI 互动游戏的 GPT 时刻到了!谷歌Genie 3首测!太牛了!

谷歌去年发布世界模型Genie 3,支持实时生成可交互视频内容,因成本高未开放。现美国18岁以上Ultra用户可试玩,其操控延迟低、画面清晰、物理交互真实,还介绍了操作流程等。

歸藏的AI工具箱
新闻资讯7

首页大翻新,Agent HQ 上线!回归微软后,GitHub 不再是你认识的 GitHub 了?

2025 年 GitHub 回归微软后再出发,新负责人 Jared Palmer 带来变革。发布 Agent HQ 整合第三方编码代理,重构首页成工作起点。GitHub 正从代码托管走向开发者与智能体协中枢。

InfoQ
产品应用8

「动嘴办公」火起来了!TRAE SOLO让打工人张嘴就能干活

新智元报道,TRAE SOLO与Insta360联名推套装,实现「动嘴办公」。它能智能转录、修正语义、直调功能,可处理代码、文件等。还能过滤口语、理解语义,降噪拾音。4月底将上线实时问答互动。

新智元
产品应用7

Cursor 内置三大文档工具,为AI 编程注入精准上下文

大模型编程易因知识陈旧致代码出错,为其提供实时上下文是关键。Cursor 有 @Docs、@Web、MCP 三大文档工具,能处理不文档,还可协助创建和更新文档,弥合模型知识与项目需求的鸿沟。

AI工程化
产品应用8

灭霸带着复联放烟花!16秒,让手搓 AI 视频拥有大片即视感

生数科技的Vidu Q3超越Sora 2,位居全球第二、中国第一。它能16秒声画出、叙事能力强、镜头和文字渲染出色,还降低了视频制作门槛,可用于漫剧、短剧、影视剧制作。

AI科技评论
开源动态8

刚刚,创智+模思发布开源版Sora2,电影级音视频步生成,打破闭源技术垄断

今天上午,上海创智学院 OpenMOSS 团队与模思智能发布端到端音视频生成模型 MOVA,它是中国首个高性能开源音视频模型,能实现音画出,全栈开源打破闭源技术垄断。

机器之心
开源动态8

52KB 的奇迹!NovaSR 开源:16kHz 秒变 48kHz,快出天际的音频超分模型!

在AI“巨物崇拜”盛行时,NovaSR开源带来“微型震撼”。它仅52KB,能将16kHz音频提至48kHz,单张A100达3600倍实时。可端侧运行,效率提升显著,有诸多应用场景。

开源星探
开源动态8

PPT制作和演示,用这个开源项目就够了,直接安全高效!

Bento 演示文稿是 PowerPoint 替代品,是单个 HTML 文件,约 560KB,无需安装等,打开即用。它功能丰富,如 Morph 演示、实时协作等,还支持与 AI 结合,具备多种关键技术,从源码构建也很方便。

GitHubStore
产品应用7

英伟达用NIM + NV-Tesseract模型,提高芯片生产良率

芯片制造良率控制难题待解,统方法各有局限。英伟达推出NV - Tesseract模型家族和NIM推理微服务,二者结合用于半导体晶圆厂生产,可实时发现问题、预测故障,降低成本,为制造打开新大门。

AIGC开放社区
算法论文7

一段 signature,不仅撬开了 Opus 的隐藏推理,还让 Kimi、GLM 露出了"熟悉感"

研究者发现,将 Opus 等强模型返回的加密推理块交给家族弱模型,弱模型可能转写出隐藏内容。如用 Haiku 读取 Opus 的加密信息。此外,公开的 Agent 轨迹存在隐私泄露风险,部分开源模型易受 Opus 风格影响。

深度学习自然语言处理