三维场景视频编辑」共找到 2813 篇相关文章

8

估值200亿美元!可灵AI被曝剥离快手单独融资

The Information爆料,快手计划分拆旗下视频生成模型可灵AI,目标估值200亿美元并计划明年IPO。可灵已开始盈利,在海外表现出色。快手拆分是因估值重构、资源压力和人才等三层压力。

量子位
算法论文8

PixelRefer :让AI从“看大图”走向“看懂每个对象”

多模态大模型多停留在整体场景级理解,现实任务需细粒度、对象级理解。浙江大学等联合提出PixelRefer框架,可实现精细视觉指代与推理,在多项任务表现领先,轻量版性能优,还开源两类数据集。

机器之心
产品应用8

京东AI「结果」:深度应用已成当下,万亿生态瞄准未来

9月25日,“2025京东全球科技探索者大会”展示了京东AI的深度应用成果。京东发布全新JoyAI大模型及三大AI产品,展示其在多场景的应用,还升级多个平台,未来三年将投入带动万亿规模AI生态。

机器之心
新闻资讯7

李飞飞一年前究竟说了啥?怎么又火了

AI教母李飞飞一年前访谈再引关注,她指出大语言模型或许并非真正智能,其基于一维语言信号训练,在理解三维物理世界存在局限。相关实验也证实大模型在物理任务表现差,不过也有人提出不同观点。

量子位
开源动态7

美团也开源了大模型,但我觉得他们的野心是通用生活Agent。

美团发布并开源560B参数的MoE模型LongCat - Flash - Chat,推理速度快。与DeepSeek V3对比,输出速度优势明显。美团多个落地或内测AI功能服务C端生活场景,目标是打造通用生活Agent。

数字生命卡兹克
产品应用8

马斯克放出编程界价格屠夫!Grok Code Fast 1:更快,更省,还免费

近日,马斯克旗下xAI发布全新编程模型Grok Code Fast 1,它为“代理式编程”而生,靠全新架构实现高速代码生成。在技术出色的同时,价格低廉还限时免费,虽在部分场景有不足,但仍是开发者实用工具。

AIGC开放社区
产品应用8

一手实测深夜发布的世界首个设计Agent - Lovart。

博主实测深夜发布的世界首个设计 Agent - Lovart。虽内测版细节粗糙,但大框架已现。它先匹配设计风格,再创建执行计划,还支持二次编辑等,集成多工具可生成视频等,未来或重写设计工作流。

数字生命卡兹克
新闻资讯7

从实验室到工厂:具身智能如何跨越商业化的“死亡谷”?|甲子引力X

4月28日「AI共潮生——2025甲子引力X科技产业新风向」大会上,五位嘉宾围绕具身智能分享见解。当前行业处概念到商用过渡期,梅卡曼德邵天兰等四位机器人领军人物探讨商业化路径,指出需聚焦场景、降成本、强技术可靠性。

甲子光年
开源动态8

AgentScope 正式发布 Skills 支持 - 实现渐进式披露

文章指出大语言模型驱动的Agent系统存在核心矛盾,常见上下文加载方案有局限,缺乏灵活机制。介绍了AgentScope发布的Skill机制及渐进式披露策略,还讲了其在Java中的实现,最后分析了适用与不适用场景

阿里云开发者
算法论文8

停止迷信“超级Prompt”:要想AI不犯错,你得专门雇人“怼”它

这篇来自Isotopes AI的论文指出,在生成式AI落地中,迷信‘超级Prompt’不可取。对于高风险场景,单体LLM有局限,论文构建‘AI Office’架构,引入‘对手团队’概念,实验使准确率从60%提升到92.1%,但也有成本和局限。

深度学习自然语言处理