3D世界生成」共找到 4488 篇相关文章

开源动态8

没想到,音频大模型开源最彻底的,居然是小红书

近几个月,开源成AI社区焦点,国内厂商七八月开源多款大模型,但音频生成占比小。小红书技术团队自去年起在音频领域稳定开源,成果覆盖TTS、ASR方向,具商用属性,降低落地门槛。

机器之心
新闻资讯8

他用AI办了个音乐节,主题:别读博

科研人“馄饨皮茄总”用AI办“不读博音乐节”,系列歌曲在B站获超5000万次播放。他用科研方法论做音乐,选歌、填词、生成音乐都有严格标准。歌曲治愈了科研人,也让他找到与世界的连接。

量子位
产品应用8

告别 AI 土味审美!Kimi K2.5 实测:扔个视频复刻 iOS 级丝滑动效

Kimi 上线 K2.5 模型,前端审美佳,接近 Gemini 3,增强多模态识别,支持视频。测试显示它能按要求生成漂亮网页,还可通过反馈迭代。它对设计师和普通人帮助大,且 Agent 模式任务完成率高。

歸藏的AI工具箱
新闻资讯8

CES 2026超前瞻:空间智能来势汹汹!从实验室奢侈品到消费级刚需,如何重塑 AI 具身时代?

2026年CES展上,空间智能从学术概念迈向产业实践。当前具身智能存在‘语言强、手脚笨’困境,空间智能是破解关键。全球分世界生成与空间决策两条技术路径,且行业正迎来成本降低的拐点。

机器之心
算法论文8

SIGGRAPH Asia 2025|30FPS普通相机恢复200FPS细节,4D重建方案来了

3D视觉领域难题是用普通摄像机将高速世界转为数字化4D时空。受限于成本和带宽,现有方法有局限。本文提出“异步采集 + 视频扩散模型修复”方案,用30 FPS相机恢复100 - 200 FPS动态细节。

机器之心
产品应用8

手机跑推理模型:Liquid AI发布仅需900MB内存的LFM2.5-1.2B-Thinking

Liquid AI发布LFM2.5 - 1.2B - Thinking推理模型,仅需900MB内存就能在手机运行。它专为简洁推理训练,性能提升明显,多数性能基准超Qwen3 - 1.7B,在多平台表现佳,还支持主流推理框架。

AI工程化
算法论文8

众所周知视频不能P?北大施柏鑫团队、贝式计算CVPR研究:视频里轻松换衣服、加柯基

视频编辑难度高,传统流程繁琐,现有AI方法有局限。北大施柏鑫团队联合贝式计算等提出VIRES方法,能实现视频主体多种编辑操作,还标注VireSet数据集。其在多指标超现有SOTA模型,团队还探索全景级可控视频生成

机器之心
新闻资讯7

ChatGPT开测广告!OpenAI终于向“钱”看

OpenAI宣布在美国免费版及Go版测试ChatGPT广告功能,称是为支撑免费用户使用。广告不影响回答内容,会注明“赞助内容”。此外,新发布的GPT - 5.3 - Codex广受好评,还将推新聊天模型,其融资计划也在升温。

量子位
新闻资讯8

AI办公硬件新标杆:未来智能携viaim亮相CES 2026,斩获微软人工智能创新奖

1月6 - 9日,CES 2026在拉斯维加斯启幕,中国企业未来智能携viaim参展。其讯飞AI会议耳机Pro3与Air2吸引观众,还获微软“人工智能创新奖”。产品精准定位办公场景,全球化布局成果初显,正构建全场景AI办公生态。

AI前线
新闻资讯7

AI祛魅之后:2026年将是AI脱下华丽外衣并穿上工装的一年

2026年AI将从概念验证迈向产业深处,展现实用价值。行业焦点从构建大模型转向让AI好用,还会从依赖算力扩张过渡到研究新架构。小模型崛起、智能体互联标准化、世界模型构建及物理智能落地成趋势。

AIGC开放社区