视频更新」共找到 1493 篇相关文章

算法论文8

ICML 2026 Oral | 为3D空间智能数据构建全自动数据飞轮,Holi-Spatial打造400万级空间多模态数据集

来自多机构的研究团队提出 Holi - Spatial,可从原始视频自动生成 3D 重建等数据,构建 400 万级空间标注数据集 Holi - Spatial - 4M,提升 VLM 空间能力,还形成自动化数据飞轮,但存在计算成本高、特定场景表现不佳等局限。

机器之心
新闻资讯7

字节、快手、小红书之后,阿班押注下一代种草要从“围观”走向“体验”

Dreamova 创始人阿班在经历字节、快手、小红书工作后创业,定位 AI 时代「体验式生活方式平台」。他认为 00 后不满足围观式种草,要自己体验。产品让用户将喜欢的生活方式一键变成体验视频,可代入调整。

Founder Park
产品应用7

00后下场整顿Agent:啥都不学就能用好AI,这才是正确打开方式

AI圈模型变强但使用门槛变高,00后团队打造的胖鹅AI以低提示词为卖点,实测在生成视频、数据看板网页等方面表现出色。其核心是SOP体系,让AI适应人的习惯,降低使用门槛。

量子位
开源动态7

单Agent时代结束,AI们开始组团上班

月之暗面发布并开源K2.6,重点升级代码能力与多Agent协作的“Agent集群”能力。K2.6在Artificial Analysis上取得全球开源第一,实测能并行交付多格式成果,还展现出强大的全栈应用开发能力。

量子位
推荐文章7

我们就这样在一起搞了两年

作者2024年离开特赛发后创业,用积蓄和炒股所得作为本钱。项目避开大语言模型和视频生成,选教育领域做考研调剂志愿填报,用agent完成工作。产品销售不错,作者虽有心理波动但坚持,未来想尝试新领域。

Agent的潜意识
算法论文8

挤干大模型高分「水分」!最强模型仅49分,南大傅朝友发布Video-MME-v2

南京大学傅朝友团队在 Google Gemini 评测团队邀约下推出视频理解新基准 Video-MME-v2。它有创新的分层能力体系与组级非线性评分,揭示模型与人类的巨大鸿沟、传统 Acc 指标虚高、“Thinking”并非总是增益等现象。

机器之心
新闻资讯8

同一天,百度、OpenAI双双发力高智能AI!先来实测一波原生全模态文心5.0

2025年,OpenAI凌晨更新GPT - 5系列,百度在世界大会发布文心5.0。它采用原生全模态统一建模技术,参数达2.4万亿,评测领先。实测表现佳,其技术在多方面突破,为大模型演进提供路径,助百度重回竞争中心。

机器之心
开源动态8

LangChain 彻底重写:从开源副业到独角兽,一次“核心迁移”干到 12.5 亿估值

本周,LangChain 宣布完成 1.25 亿美元融资,投后估值 12.5 亿美元,还发布里程碑式更新,LangChain 1.0 正式登场,这是一次从零开始的重写。它最初是副业,后成热门开源项目,此次重写解决了过往问题。

InfoQ
新闻资讯7

就在刚刚,ChatGPT发布了一个新功能Pulse

北京时间凌晨,山姆·奥特曼宣布 OpenAI 为 Pro 用户上线 ChatGPT Pulse 预览版,后续会扩展到 Plus 用户及所有人。Pulse 核心是主动推送个性化更新,能结合多信息生成内容,但需用户开放大量个人数据,隐私问题值得关注。

MacTalk
新闻资讯8

00后8亿美金「掀桌」!硅谷AI将书写影视新传奇,终结制片旧时代

00后华人女CEO Cecilia Shen带队转型Cybever为全球首家AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术从3D虚拟环境生成发展到完整视频制作,还推出两部大作,或改变影视行业格局。

新智元