短视频生产」共找到 1488 篇相关文章

推荐文章8

AI 开发时代的“能力暴露与禁止空间”方法论:TPDD 与高层测试闭环

文章指出大模型加速软件开发范式演进,AI 深度介入开发带来新生产路径,但也放大风险。作者提出 TPDD 方法论,通过提前定义测试点与边界条件,平衡能力利用与风险控制,确保系统可控、安全、可持续。

InfoQ
新闻资讯7

机器人成精了?Figure 03下厨房,不经意关抽屉那一下,太像人了

新智元报道,Figure AI推出搭载Helix 02系统的机器人Figure 03。视频中它在厨房自主干活,如用胯顶抽屉、用脚抬门,还展现多核心能力。其突破传统难题,实现行走与操作统一,能胜任家庭细活。

新智元
算法论文7

VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景

上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有板。

机器之心
新闻资讯7

宇树IPO搁浅传闻满天飞,王兴兴:别当真,也不用和外人解释

宇树科技回应“A股上市绿色通道被叫停”传闻,称未申请绿通,上市工作正常推进,还发H2机器人训练视频。创始人王兴兴称消息是乱编的,别当真也不用解释,相关不实报道已下架。

量子位
开源动态8

Jina-VLM:可在笔记本上跑的多语言视觉小模型

Jina AI 发布 2.4B 参数量的视觉语言模型 Jina-VLM,在多语言视觉问答任务达 SOTA。它引入注意力池化,连接视觉与语言基座,支持 29 种语言,能高效处理问答等任务,对硬件需求低。

Jina AI
算法论文8

谢赛宁×李飞飞×LeCun首次联手!寒武纪-S「空间超感知」AI震撼登场

Yann LeCun、李飞飞和谢赛宁联手发布论文「Cambrian - S:迈向视频中的空间超感知」。他们认为LLM虽能力强,但无法像人类一样感知世界,为此构建Cambrian - S系列模型,开源相关数据和模型,还开发了新原型。

新智元
新闻资讯8

OpenAI引爆新赛道:AI不再卖技术,而是卖「活人感」!

一段小女孩与AI玩具深情告别的视频走红,揭示对话式AI融入人类情感世界。声网Convo AI&RTE 2025大会指出对话式AI将成下一代AI Infra重要部分,情感陪伴、智能硬件、在线教育将率先规模化落地。

新智元
产品应用7

如何构建企业级数据智能体:Data Agent 开发实践

本文介绍DMS的数据分析智能体Data Agent,它从实验室走向企业生产一线,革新数据分析范式。文中剖析构建要点,对比与传统BI、高级分析差异,阐述技术内核优化及企业级能力,为开发实践提供参考。

阿里云开发者
开源动态8

超越英伟达Describe Anything!中科院 & 字节联合提出「GAR」,为DeepSeek-OCR添砖加瓦

中科院与字节联合提出「GAR」,为构建自然图像的Dense Caption提供新思路。GAR具备精准描述、关系建模和组合推理能力,通过引入新组件,兼顾细粒度与全局上下文,在多测试集表现优异,且代码等已开源。

量子位
开源动态8

谷歌最强AI,被港科大开源超了?让海外创作者喊出「King Bomb」的P图大杀器来了

图像编辑与生成模型爆发,冲击Photoshop地位。港科大贾佳亚团队开源DreamOmni2,优化升级多模态指令编辑与生成能力,效果获海外创作者认可,还在实测中表现出色,其采用创新技术方案构建多模态生成体系。

机器之心