「Hermes V3」共找到 2384 篇相关文章
落地商用开启国产一体化智算新时代,蓝芯算力LX500亮相滴水湖RISC-V产业论坛
2026年8月13日,第五届滴水湖中国RISC - V产业论坛召开。蓝芯算力生态营销负责人许庆伟以核心产品LX500为线索,从架构、算力、商业落地三方面,展示国产RISC - V算力商用路径。
一句话生成无限逼真3D场景!匹兹堡大学新作直击VLM空间推理软肋丨CVPR'26
VLM在3D空间推理上表现不佳,且缺乏合适测试基准。匹兹堡大学团队提出InfiniBench框架,用LLM Agent迭代优化和聚类策略,可按需生成3D场景,还能精准定位大模型空间推理缺陷。
Transformer开始构建三维世界:开源模型几张图片秒级生成可探索3D场景
影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量图片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。
影身智能完成多轮融资,用原生3D数据重新定义机器人认知|甲子光年
影身智能已连续完成多轮融资,累计近亿元。其以‘原生3D动态世界模型’为核心技术,采用与市场不同的‘升维’思路,用自研的‘影身360’系统采集3D数据,还落地柔性智造行业,目标是打造通用人工智能产品。
任意骨骼系统的模型都能驱动?AnimaX提出基于世界模型的3D动画生成新范式
传统3D动画制作依赖骨骼绑定与关键帧编辑,成本高。现有自动化方法有局限。北京航空航天大学团队提出AnimaX框架,结合视频扩散模型与骨骼动画优势,支持任意骨骼拓扑,生成动画质量高、速度快,泛化能力强。
你觉得 Kimi K3 又慢又贵是吧,我来告诉你为什么
作者用 Kimi K3 为墨问的 CatReader 增加发现页,实操中它多数时候快且抗用,不过周五晚变慢,收尾工作交给了 GLM 5.2。对用户觉得 K3 又慢又贵的问题进行分析,还区分了 Kimi App 和 Kimi Code 使用场景。
实测参考生之王Vidu Q3:这已经不叫AI生成了,这叫AI驱动整个剧组
4月13日生数科技发布视频大模型Vidu Q3,在SuperClue榜单断层登顶。它从‘生成视频’转向‘驱动剧组’,升级后能嵌入内容生产流程,实现‘万物可参,声画同出’,在多赛道表现亮眼。
一个md文件收获超400 star,这份综述分四大范式全面解析了3D场景生成
南洋理工大学研究者发表《3D Scene Generation: A Survey》综述,系统归纳300+篇论文,将3D场景生成方法分四大范式解析,还总结应用,探讨挑战与未来方向,如保真度提升、引入物理约束等。
腾讯混元世界模型1.1开源:单卡秒级重建3D世界成为现实
腾讯混元团队开源混元世界模型1.1,它是混元3D世界模型1.0升级版。新增多视图及视频输入,单卡可部署,秒级创造3D世界。有核心突破,能处理多任务,经训练策略优化,多测试表现佳。
GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~
智谱继GLM-4.1V-9B-Thinking、GLM-4.5后,又开源最强多模态推理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉推理强,经测试能助力科研各阶段,还介绍了其架构设计与训练策略。