4D场景重建」共找到 3343 篇相关文章

产品应用7

Alibaba力作:Ovis-U1 融合理解、生成与编辑,解锁无限可能

OpenAI 2025 年推出的 GPT - 4o 结合图像与语言能力,但引发视觉解码器设计及统一模型训练问题。Alibaba 力作 Ovis - U1 单一模型能完成理解、生成与编辑任务,介绍了其架构、训练过程和应用。

CourseAI
产品应用7

文旅新玩法!藏师傅教你做食物微缩景观宣传海报&视频

作者玩 Gpt - 4o 图片生成时,用食品做键盘图,又结合食物与城市做微缩场景海报,还用 Veo3 做微缩景观生长动画,给出各工具提示词,鼓励大家尝试。

歸藏的AI工具箱
产品应用8

豆包专业版实测:2亿人都可以体验能干活的Agent了!

6月24日,豆包上线专业版,搭载首个Agent驱动的办公任务模式。实测显示其在办公场景交付质量对标Claude Opus 4.6。2亿日活用户可体验,免费用户功能升级,专业版满足复杂任务额度需求。

新智元
开源动态8

参数砍到 1B,这个小钢炮拿下多模态第一

面壁智能发布并开源参数量仅 1.3B 的 MiniCPM-V 4.6,虽小但多模态综合能力在 1B 级别中夺冠。它推理快,效率高,靠两大架构创新实现,还为开发者提供完整工具链。

AGI Hunt
产品应用8

MiniMax M2.5发布:硬刚 Claude Opus,一美元包断一小时的生产力

MiniMax M2.5发布,硬刚Claude Opus 4.6,以一美元包断一小时的低价降低AI生产力门槛。它在编程、办公等多场景表现出色,速度快且成本低,背后是RL Scaling等技术支撑。

AIGC开放社区
开源动态8

这个项目专治建模手残党,给张图就能转变可编辑能转动的3D模型

img2threejs上线11天获4.8k Star,专治建模手残党。给它一张图,它让AI写代码把物体“搭”出来,不重建几何,也不下素材包,还省Token、零依赖,有严格质量门控。

GitHubStore
开源动态8

表格理解新纪元!上交大等联合开源,半结构化表格问答准确率提升40%!

数据密集型工作中半结构化表格处理难,传统工具和GPT - 4o表现不佳。上海交通大学等联合开源ST - Raptor,通过VLM、HO - Tree算法和LLM推理,解决复杂表格问答问题,支持多格式,适用于多场景

开源星探
算法论文8

GPT-6 或有"生命"!MIT新作实现LLM自我进化,冻结权重时代终结

MIT新作《Self-Adapting Language Models》实现LLM自我进化,SEAL框架让模型自己生成“自编辑”微调自身。它能实时学新数据、修复知识、形成记忆。经两种场景验证,小模型也能超越GPT - 4.1等。

PaperAgent
产品应用8

把抖音的研发管理搬到车企,跑得动吗?

飞书项目在深圳新品发布会推出整车研发解决方案,首次明确‘平台化’定位并公开产品架构。其方案覆盖架构整合等四场景,还进行技术升级,如轻应用、Project 4K 计划等,已获车企实践验证。

InfoQ
新闻资讯7

独家丨国内人形机器人首笔千台级商单出现

AI科技评论独家获悉,星尘智能与仙工智能达成人形机器人千台级订单战略合作,今年4季度起部分交付。这是国内人形机器人在工业领域最早一批千台级商单,双方采取‘供应链+产品+渠道’合作。

AI科技评论