「3D场景生成」共找到 5195 篇相关文章
大神Karpathy都投的AI实时视频生成模型:直播都能立即转,无限时长几乎零延迟
AI初创公司Decart推出首个零延迟无限实时视频生成的AI模型MirageLSD,大神Karpathy都投资了。它能实时生成视频流,无时长限制且延迟低至40毫秒以下,还攻克了传统模型‘误差累积’难题。
“神级模型”Gemini 3.0实力刷屏!联手谷歌全新氛围编程工具重塑前端,如今只差官宣
谷歌发布“vibe coding”版AI Studio,产品形态向可视化构建转变。有迹象显示Gemini 3.0将发布,二者结合或重塑前端开发。AI Studio速度快、易用,Gemini 3.0在前端开发测试中表现出色,谷歌借此参与AI竞赛。
斯坦福意外用AI生成超强CUDA内核,性能比人类专家优化得还要好!翻倍碾压原生PyTorch,华人主创
斯坦福团队意外发现AI生成的内核性能超人类专家优化的,在常见深度学习操作上能让性能提升近400%。其方法是生成自然语言优化思想再转化为代码,还使用多分支探索模式。
7B模型对标GPT-4o,全球首个医疗代码生成大模型训练平台来了
研究团队发布全球首个医疗代码生成大模型训练平台MedAgentGym,提供评估基准和训练生态,提升大模型医疗代码生成与推理能力。经其训练的Med - Copilot - 7B达GPT - 4o相当水平,解决医疗AI编程瓶颈。
CVPR 2026|突破3D空间推理瓶颈:北大联合南科大提出QuatRoPE,让大模型精准理解三维物体关系
北大联合南科大团队提出全新 3D 位置嵌入方法 QuatRoPE,改善大语言模型 3D 空间推理痛点。还提出 IGRE 降低干扰,构建 ASR 基准评估能力。研究被 CVPR 2026 接收,代码与模型已开源。
Shopee OnePiece:业内首个融合上下文工程、隐式推理和多目标训练策略的生成式搜推建模框架
2025年生成式推荐发展火热,但工业界落地多在序列化建模,替换传统范式遇阻。Shopee傅聪团队联合人大高瓴学院提出OnePiece范式,是业内首个融合多策略的生成式搜推建模框架,含上下文工程、隐式推理和多目标训练策略。
反超Gemini 3!马斯克放出Grok4.1快速推理版,还曝出了新一轮150亿美元融资
Grok4.1被Gemini 3反超后,据华尔街日报爆料,xAI正计划150亿美元融资,公司估值将达2300亿美元。xAI成立两年多来估值飙升,马斯克还发布Grok 4.1 Fast击败Gemini 3。
99%的AI产品都没有真正的护城河,初创产品需要做好「细分场景+生态协同」 | 对话AI播客工具Podwise
量子位智库对话Podwise创始团队,探讨AI播客工具发展。团队分享Podwise目标用户、场景、优势,如转录准、能识别声纹等。还谈及产品开发、付费、用户增长等策略,强调做好细分场景与生态协同。
AI 互动游戏的 GPT 时刻到了!谷歌Genie 3首测!太牛了!
谷歌去年发布世界模型Genie 3,支持实时生成可交互视频内容,因成本高未开放。现美国18岁以上Ultra用户可试玩,其操控延迟低、画面清晰、物理交互真实,还介绍了操作流程等。
Nano Banana Pro或将引爆新安全危机
基于Gemini 3的图像生成模型Nano Banana Pro昨日上线,支持2K/4K分辨率生成,排版和文字控制能力提升。它展现出复杂推理能力,能理解反光、推理指纹,但这或带来隐私危机。