实时计算」共找到 1009 篇相关文章

产品应用8

世界首个「实时、无限」扩散视频生成模型,Karpathy投资站台

Decart发布世界首个「实时、无限」扩散视频模型MirageLSD,输入视频流能快速转化画面,前特斯拉AI总监Karpathy投资。它在时长和延迟上有突破,也有需改进之处。

机器之心
新闻资讯7

100亿美元联姻,Meta与Google的AI云计算豪赌

近日,Meta与Google签署超100亿美元、为期六年的云计算协议,Meta用Google Cloud支持AI基建。该交易规模大,源于Meta算力需求迫切与Google TPU优势,也反映AI军备竞赛现状,预示行业新格局。

AIGC开放社区
算法论文7

手机上实现AI视频实时生成,DiT模型上移动端

扩散变换器在视频生成任务性能强,但计算成本高,在手机上难实用。Snap提出创新优化法,加速视频生成,能在iPhone 16 Pro Max上每秒超10帧,不过也存在细节退化等局限。

带你学AI
新闻资讯7

20瓦就能运行下一代AI?科学家瞄上了神经形态计算

当前AI面临“能源危机”,耗电量成沉重负担。科学家正尝试打造占地小、神经元数量堪比人脑皮层的神经形态计算机,其运行快、功耗低。神经形态计算模拟人脑,或成下一代AI关键。

量子位
开源动态7

Hermes Agent 发布更新 Herald:实时语音 + Agent 之间可以互相通信了

Hermes Agent 更新到 v0.20.0 代号 Herald,增加实时语音对话与唤醒词,可验证引用来源可信度,集成签名Webhook,支持代理到代理协议,还有性能与安全方面更新,顺应新 Agent 发展趋势。

AI工程化
算法论文7

现实世界的天气能复刻?Weather-Magician实时渲染下雨打雷下雪

传统工业方法在还原复杂现实场景时成本高、质量差,当前算法也难重建和渲染真实天气效果。上海交通大学提出Weather - Magician框架,能重建场景并渲染4D天气效果,对硬件要求低且可实时渲染。

带你学AI
开源动态8

“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理新范式

Mini - Omni - Reasoner将推理能力引入大型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性能超基础模型。

GitHubStore
开源动态8

字节推出X-Streamer,实时口型同步与长程记忆数字人框架

字节推出端到端多模态人类世界建模框架X - Streamer,能从单张人像构建可无限流式生成的数字人,实现音素级口型同步和长程记忆。其核心是“思考者–行动者”双Transformer架构,在两张A100 GPU上可实时运行。

带你学AI
7

强化学习之父:LLM主导只是暂时,扩展计算才是正解

新晋图灵奖得主、强化学习之父Richard Sutton在新加坡国立大学演讲时预测,大模型主导是暂时的,未来五年甚至十年内不是技术前沿。他认为AI应从依赖人类数据转向体验学习,强化学习潜力需靠扩展计算支撑。

量子位
开源动态8

仅需0.7秒单图像实时3D重建,开源扩散模型

单图像3D重建是计算机视觉难题,传统基于回归和生成式方法各有局限。Stability - AI开源SPAR3D模型,融合两种方法规避局限,仅0.7秒完成单图实时3D重建,实验显示性能显著优于其他基线方法。

AIGC开放社区