商汤悟能」共找到 5073 篇相关文章

产品应用7

英伟达DLSS 4.5来了:Transformer再进化消除鬼影,“拼好帧”最高提至6倍还动态调节

CES 2026英伟达在中国媒体见面会介绍了DLSS 4.5,它采用“双核心”策略,画质核心用第二代Transformer模型解决鬼影和闪烁,性核心支持6倍插帧并动态调节,还推出G - SYNC Pulsar降低动态模糊。

量子位
开源动态8

我去,还这么玩?AI新宠DocExt:纯本地文档抽取,开源免费还无依赖!你还在为OCR头疼吗?

DocExt 是 Nanonets 开源项目,为全流程无 OCR、零云依赖的本地文档结构化提取工具,适用于多种文档类型,支持字段与表格识别。它零 OCR 误差小、可本地部署,还灵活接入模型。

小华同学ai
开源动态8

图像界的DeepSeek!12B参数对标GPT-4o,5秒出图,消费级硬件就玩转编辑生成

Black Forest Labs开源旗舰图像模型FLUX.1 Kontext[dev],专为图像编辑打造,在消费级芯片运行。12B参数少、推理快,性媲美闭源模型。有诸多特点,经优化训练,在KontextBench基准表现优。

量子位
产品应用7

单张消费级显卡也参与大模型训练!无问芯穹用「三个盒子」打通十万卡到一张卡AI效跃升路径

2025年WAIC上,无问芯穹联合创始人夏立雪带来AI落地新解——三个盒子,即无穹AI云、无界智算平台、无垠终端智,是面向未来的智基础设施设计,打通从十万卡到一张卡的AI效跃升路径。

量子位
产品应用8

首款推理具身模型,谷歌DeepMind造!自主理解/规划/执行复杂任务,打破一机一训,还互相0样本迁移技

谷歌DeepMind发布新一代通用机器人基座模型Gemini Robotics 1.5系列,由GR 1.5和GR - ER 1.5组成,结合视觉、语言与动作,实现“规划 + 执行”闭环,还提出Motion Transfer机制,跨机器人迁移技

量子位
产品应用8

π0.7的泛化力有多强?零样本纯靠口述就用空气炸锅,演示完换个机械臂也叠衣服

2026年4月16日,美国明星机器人AI公司Physical Intelligence发布模型π0.7。它具组合泛化力,借助多模态提示框架,零样本完成新任务。在空气炸锅、叠衣服等实验中表现出色,有望推动具身智发展。

DeepTech深科技
产品应用8

还在手搓PPT?试完这款AI,我连夜卸载了付费模板库

新智元报道,今年AI从「卷分数」变为「卷干活」。商汤升级的「办公小浣熊3.0」是超级「办公搭子」,做PPT、分析数据、写报告。其APP即将上线,还实现全链路国产化适配。

新智元
开源动态8

这个新生图模型有点夯:4K直出的,国产的,开源的!

商汤新开源的生图模型SenseNova U1.5-Lite-Preview亮点十足,它是国产、4K直出、轻量且可指哪儿改哪儿的原生统一多模态模型。应对复杂创作和编辑任务,技术源于NEO-Unify架构,评测成绩佳,不过还是早期预览版。

量子位
产品应用8

一个APP就拍短片!人物、字幕、BGM……AI Agent统统自己搞定

剪映旗下内容创作Agent小云雀上线新功,可文生数字人,还根据提示词生成视频。它有“参考图生视频”玩法,解决图片混剪难题。依托字节模型,创作门槛低,交付质量高,限时免费。

量子位
新闻资讯7

Meta发布40页报告,具身智的下一步是「心智世界模型」:听,看,理解,会共情

Meta发布40页报告,首次将对人心智状态的推断概念化为心智世界模型,与物理世界模型实现“双轨建模”。还指出要结合系统A和B让AI自主学习,心智世界模型在多智体协作潜力大。

量子位