设计与代码」共找到 8218 篇相关文章

算法论文8

VEGA-3D:释放视频生成模型中的隐式3D知识,重塑3D场景理解具身交互

华中科技大学百度联合提出VEGA - 3D,释放视频生成模型隐式3D知识。它将视频生成模型作‘潜在世界模拟器’,用自适应门控融合机制,提升场景理解等任务表现,无需额外3D标注数据。

机器之心
推荐文章7

智能流体力学专题研讨会特邀报告3|边鑫:混合深度学习迭代方法的粘性不可压流动加速求解

2026年8月,第十四届全国流体力学学术会议在青岛举行,智能流体力学专题研讨会展示了人工智能流体力学交叉领域进展。边鑫作《混合深度学习迭代方法的粘性不可压流动加速求解》报告,介绍HyDEA求解框架。

力学与人工智能
开源动态8

原生3D-VAEs,1536³三维分辨率,清华微软TRELLIS 2开启3D全能生成新纪元

清华微软团队推出TRELLIS 2系统,用全新O-Voxel表示法,1分钟生成1536³分辨率3D资产。它解决拓扑灵活性存储效率矛盾,结合SC-VAE和流匹配模型,在多方面超越现有模型,还能适应不同场景。

AIGC开放社区
新闻资讯7

北京艺术科技周|三联人文城市跨界沙龙:当AI开始写诗、作曲,我们会如何改变?

在算法推荐和AI生成内容充斥的当下,美学标准和感知方式被颠覆重塑。北京艺术科技周的三联人文城市跨界沙龙,邀胡德夫、叶蓓等嘉宾以诗为起点深度对谈,探讨AI时代美学人文生活新可能。

798艺术区
开源动态8

首个基于MCP 的 RAG 框架:UltraRAG 2.0用几十行代码实现高性能RAG, 拒绝冗长工程实现

检索增强生成系统(RAG)复杂度提升,工程实现成本高。清华大学等联合推出首个基于MCP架构的UltraRAG 2.0,组件化封装、调用扩展灵活,低代码实现高性能,可用于科研和行业应用。

AI前线
算法论文8

登上NeurIPS,Genesis开创无需OCC引导的多模态生成新范式,在视频激光雷达指标上达到SOTA水平

华中科技大学小米汽车提出多模态图像 - 点云联合生成框架Genesis,采用两阶段架构和DataCrafter模块。在nuScenes数据集实验显示,其在视频激光雷达指标达SOTA水平,还提升了下游感知任务效果。

机器之心
推荐文章7

Qwen2.5VL新玩法,看电影讲故事

本公众号关注AI前沿技术,分享实战案例课程。介绍视觉叙事技术及挑战,基于Qwen2.5 - VL 7B模型微调Qwen Storyteller,构建StoryReasoning数据集,还给出实战代码及相关链接。

CourseAI
推荐文章7

《中国金融机构人才发展培训白皮书(2026)》发布!助力金融机构打造“人 + 智能体”协同的超级员工梯队 | 极客时间企业版

在AI时代,金融人才培养正经历深刻变革。《中国金融机构人才发展培训白皮书(2026)》应运而生,揭示了AI重塑金融人才培养的关键发现,极客邦科技和极客时间企业版也给出了相应方案。

AI前线
产品应用7

苹果憋一年终超同参数 Qwen 2.5?三行代码即可接入 Apple Intelligence,自曝如何做推理

今年 WWDC 大会上,苹果推出专为增强 Apple Intelligence 功能的语言基座模型,含约 3B 参数紧凑型基于服务器的混合专家模型。经优化可在苹果芯片高效运行,改进工具使用推理能力,评测显示设备端模型表现优。

AI前线
7

刚刚,「吉卜力狂欢」GPT-4o功臣被挖走!华南理工女学霸曾奥特曼同台

GPT-4o引爆全球「吉卜力风格」风潮后,其核心成员华南理工学霸Lu Liu伯克利博士Allan Jabri跳槽Meta。此前他们在OpenAI主导多模态AI研究,奥特曼同台展示关键功能,此次挖角凸显OpenAI人才流失危机。

新智元