出行与生活」共找到 6630 篇相关文章

算法论文8

VEGA-3D:释放视频生成模型中的隐式3D知识,重塑3D场景理解具身交互

华中科技大学百度联合提出VEGA - 3D,释放视频生成模型隐式3D知识。它将视频生成模型作‘潜在世界模拟器’,用自适应门控融合机制,提升场景理解等任务表现,无需额外3D标注数据。

机器之心
推荐文章7

智能流体力学专题研讨会特邀报告3|边鑫:混合深度学习迭代方法的粘性不可压流动加速求解

2026年8月,第十四届全国流体力学学术会议在青岛举行,智能流体力学专题研讨会展示了人工智能流体力学交叉领域进展。边鑫作《混合深度学习迭代方法的粘性不可压流动加速求解》报告,介绍HyDEA求解框架。

力学与人工智能
开源动态8

原生3D-VAEs,1536³三维分辨率,清华微软TRELLIS 2开启3D全能生成新纪元

清华微软团队推出TRELLIS 2系统,用全新O-Voxel表示法,1分钟生成1536³分辨率3D资产。它解决拓扑灵活性存储效率矛盾,结合SC-VAE和流匹配模型,在多方面超越现有模型,还能适应不同场景。

AIGC开放社区
算法论文8

登上NeurIPS,Genesis开创无需OCC引导的多模态生成新范式,在视频激光雷达指标上达到SOTA水平

华中科技大学小米汽车提出多模态图像 - 点云联合生成框架Genesis,采用两阶段架构和DataCrafter模块。在nuScenes数据集实验显示,其在视频激光雷达指标达SOTA水平,还提升了下游感知任务效果。

机器之心
推荐文章7

《中国金融机构人才发展培训白皮书(2026)》发布!助力金融机构打造“人 + 智能体”协同的超级员工梯队 | 极客时间企业版

在AI时代,金融人才培养正经历深刻变革。《中国金融机构人才发展培训白皮书(2026)》应运而生,揭示了AI重塑金融人才培养的关键发现,极客邦科技和极客时间企业版也给出了相应方案。

AI前线
7

刚刚,「吉卜力狂欢」GPT-4o功臣被挖走!华南理工女学霸曾奥特曼同台

GPT-4o引爆全球「吉卜力风格」风潮后,其核心成员华南理工学霸Lu Liu伯克利博士Allan Jabri跳槽Meta。此前他们在OpenAI主导多模态AI研究,奥特曼同台展示关键功能,此次挖角凸显OpenAI人才流失危机。

新智元
开源动态8

HumanSense:探索多模态推理边界,打造「察言观色会共情」的全模态交互伙伴

蚂蚁集团西安交通大学联合提出并开源 HumanSense,含评估基准推理模型。通过细粒度评测、全模态消融等研究,提出优化策略,项目已在 GitHub 和 HuggingFace 开源,推动 AI 交互体验革新。

机器之心
新闻资讯8

昆明城市专区展览里的科技生活

2025年国家网络安全宣传周在昆明开幕,同期昆明城市专区展览开展。展示了昆明数字经济成果,如AI机器人、网络安全体系建设、公安AI数字人等,还有鲜花、咖啡产业数字化及各企业安全方案。

街头巷尾
新闻资讯7

哈萨比斯传记里讲了好多八卦啊

量子位怒肝三天啃完哈萨比斯官方传记,扒出9个关于他和DeepMind的劲爆八卦,包括他大学时的潇洒生活、创业经历、投资趣事,以及扎克伯格、马斯克、辛顿等人的故事,还有DeepMind谷歌的纠葛。

量子位
开源动态7

专业抖音数据采集交互解决方案

该项目提供专业抖音数据采集交互解决方案,支持数据爬取、直播间监听、私信收发等功能。它将抖音复杂通信协议封装成 Python 函数,还介绍了各功能实现原理、运行环境及项目地址。

GitHubStore