「视频生成模型V1」共找到 9031 篇相关文章

开源动态8

本周5个yyds的Github开源项目,速速收藏!

文章介绍本周5个Github优质开源项目。有基于云服务的CloudPaste,排版强的Quarkdown,视频下载工具Media Downloader,双语翻译插件FluentRead,还有全能安卓助手LinkAndroid,各有特色功能。

开源先锋
开源动态8

字节开源版Seedance发布,超越Sora 2!

字节Alive团队发布开源版Seedance 2.0,在人类评估中超越Sora 2等。它通过统一架构、时空对齐技术和非对称训练策略,解决声画不同步和画质音质难两全问题,还建立数据流水线和测试基准。

AIGC开放社区
新闻资讯7

清华团队首发OpenClaw研究报告!

清华沈阳教授团队发布《OpenClaw发展研究报告1.0》和《OpenClaw自我研究报告1.0》,对OpenClaw做深度解读。团队在OpenClaw领域形成完整闭环,包括理论研究、模型研发等多方面工作。

新智元
算法论文8

清华新研究,Nature+Science双杀!

清华大学李勇团队分析2.5亿篇科学文献,揭示AI for Science领域矛盾:虽助科学家个体加速,却致科学界群体注意力窄化。这由当前AI模型缺通用性导致,团队推出OmniScientist系统破局限。

量子位
产品应用7

别难为 ChatGPT 了!面对海量资料,NotebookLM + Gemini 的“外挂模式”才是降维打击

Google打通NotebookLM和Gemini后,二者协作效果出色。NotebookLM可拆解复杂信息,Gemini以其为参考数据源答案更精准。二者还能基于笔记本做网站、视频、图片等,各有优势、双向协作。

AI进修生
新闻资讯7

谷歌Dreamer大神离职!「辛顿门徒」自曝错过Transformer

谷歌世界模型大牛Danijar Hafner宣布离任,他自2016年起在谷歌相关团队工作近十年,曾获辛顿指导,主导开发Dreamer系列。他还自曝曾错过Transformer,当时未在意其优势。

新智元
开源动态7

谷歌放大招了,开源命令行AI编程Agent,每天1000次免费调用,编程只是基础功能。

Google推出开源命令行AI编程Agent——Gemini CLI,基于Gemini 2.5 Pro模型,免费提供每日1000次调用额度。它不仅能编程,还具备多模态能力、实时信息整合等功能,支持定制与自动化。

开源AI项目落地
产品应用7

Qwen2.5VL又多一个娱乐场景,看电影讲故事

文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。

CourseAI
推荐文章7

王云鹤眼中的Harness:复杂优化问题,AGI灵魂争夺之战

王云鹤在知乎文章中探讨Harness Engineering,指出Agent=Model+Harness,多模型配合能提升Agent能力。还分析Harness存在的必要性,认为它是复杂优化问题,关乎AI“灵魂”之争。

机器之心
产品应用7

Anthropic 产品负责人:PRD 已死,原型万岁

Anthropic Claude Code 产品负责人 Cat Wu 指出,模型指数级进化,产品团队工作方式需重建。PM 不再写 PRD,而做原型、写 eval,团队用 Side Quest 机制,各角色工作本质合流。

探索AGI