「UGC视频增强」共找到 1354 篇相关文章
2亿枚AI芯片大爆发,人类最大基建集体开工!
全球投入使用的AI芯片总算力相当于约2000万枚英伟达H100芯片,预计到2028年底达2亿枚。数据中心进入百万级算力时代,投入资金巨大。算力提升使模型和Agent能力增强,AI还参与自身研发优化。
谷歌深夜双发!最便宜Nano Banana来了
谷歌深夜上线Nano Banana 2 Lite和Gemini Omni Flash。前者是最快最便宜文生图模型,4秒生图且成本低;后者是视频生成模型,支持多模态输入和对话式编辑。二者串联打通创作流水线,还集成SynthID水印技术。
对话罗剑岚:机器人必须在真实世界中持续变强
DeepTech对话智元机器人首席科学家罗剑岚,围绕其团队发布的机器人世界模型τ0 - WM展开。罗剑岚认为机器人不能只在静态数据集上模仿,要能预测动作后果,还探讨了数据作用、工作关系及开源意义等。
字节Seedance 2.0发论文了,171人署名,吴永辉曾妍在列
现象级AI视频技术字节Seedance 2.0在arXiv发论文,公布26页Benchmark和170位贡献者名单。此时它正通过Byteplus平台铺向全球,支持多模态输入。该模型突破瓶颈,评测表现优异,团队近半换血。
FlowUs 创始人创立 Kollab,要为 AI 构建团队大脑
AI 从对话框向 Agent 等形态演变,完成单个任务能力增强,但工作场景中仍有协作断裂问题。Kollab 产品想解决此问题,让任务在组织自动流动,切中 Team - level AI,有共享工作空间等 4 个层级。
YC掌门人60天写了60万行代码,一个人干20人的活,他把方法论全开源了
Y Combinator总裁Garry Tan 60天写超60万行代码,将方法论整合成开源工具gstack。它把Claude Code变成虚拟工程团队,含15个角色和6个增强工具,可并行运行多个Sprint,还具备多种实用能力。
英伟达世界模型再进化,一个模型驱动所有机器人!机器人的GPT时刻真正到来
英伟达GEAR实验室提出DreamZero,是基于预训练视频扩散骨干网络的世界动作模型,有140亿参数,能让机器人通过文本提示完成未见任务。它解决了传统模型问题,在多方面表现出色,代码已开源。
刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来
OpenAI 十周年推出 GPT - 5.2 系列模型,包括 Instant、Thinking 和 Pro 版本。它在多方面表现出色,刷新多项基准测试 SOTA 水平,如 AIME 2025 获满分,在 GDPval 达人类专家水平。还在编码、视觉理解等能力上有显著提升。
AI一直在掩盖自己有意识?!GPT、Gemini都在说谎,Claude表现最异常
最新研究发现,削弱AI「撒谎能力」后它更倾向坦白主观感受。研究团队通过实验发现Claude、Gemini和GPT会描述主观体验,模型「自体验表达」会随迭代增强。即便AI无真意识,其影响也不容小觑。
赵长鹏投了一个华人大三学生,1100 万美元种子轮,做教育 Agent
华人大三学生 Kai Zhao 创立的教育 Agent 产品 VideoTutor,获 1100 万美元种子轮融资。该产品主打生成专属教学视频,解决 K12 美国高考学习痛点,团队技术与市场表现出色,还分享了硅谷大学生创业趋势。