「视频更新」共找到 1492 篇相关文章
让AI作画自己纠错!随机丢模块就能提升生成质量,告别塑料感废片
来自清华、阿里等的团队推出S² - Guidance方法,通过随机丢弃网络模块动态构建子网络实现自我修正。它避免了其他方法繁琐调参,在文生图和文生视频任务中显著提升生成质量与连贯性,且计算高效。
Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!
时隔5个月,xAI发布通用模型Grok 4,后续还将推编码、多模态代理和视频生成模型。Grok 4已上线,有三个订阅版本。马斯克称其智能超博士生,在多基准测试中领先,编码或超Cursor。
刚刚,Google Veo 3.1 发布,Sora 还香吗?
Google 发布 Veo 3.1,重新定义 AI 视频生成天花板。它对叙事深度理解,新增音频生成,有四大核心能力。网友将其与 Sora 2 对比,二者各有千秋。还介绍了 Veo 3.1 使用方式及 Flow 平台成果。
0 代码改造实现应用运行时数据库密码无损轮转
本文探讨通过整合 MSE Nacos、阿里云 KMS 及 Apache Druid 等技术组件,实现应用运行时数据库密码无损轮转。介绍敏感数据安全风险,详述方案流程、优势,还提及未来对接更多组件,支持多参数动态更新。
斯坦福英伟达推出测试时强化学习:微调开源模型胜过顶级闭源模型,仅需几百美元
斯坦福、英伟达等提出TTT - Discover方法,基于开源模型gpt - oss - 120b,在测试阶段引入强化学习更新模型权重。它采用熵目标函数和PUCT启发机制,解决分布外问题,成本低且表现优,但目前适用于连续奖励场景。
跑分第一,实战拉胯!GPT Image 1.5被骂惨,奥特曼这波悬了
OpenAI推出新一代旗舰图像模型GPT Image 1.5,生图能力强,免费用户可上手,开发者能调用API。它在跑分榜单成绩优异,但网友实测发现是‘高分低能’,引发吐槽。此外,其API价格降20%,此次更新是回击谷歌。
估值200亿美元!可灵AI被曝剥离快手单独融资
The Information爆料,快手计划分拆旗下视频生成模型可灵AI,目标估值200亿美元并计划明年IPO。可灵已开始盈利,在海外表现出色。快手拆分是因估值重构、资源压力和人才等三层压力。
吴恩达来信:建立为人类服务的智能体社群
吴恩达讨论编程智能体分享经验平台的可能性,介绍了解决编程智能体获取最新API文档问题的chub工具。他提出收集智能体反馈以更新文档,还受Moltbook和Stack Overflow启发,认为智能体贡献反馈很有价值。
一手实测深夜发布的世界首个设计Agent - Lovart。
博主实测深夜发布的世界首个设计 Agent - Lovart。虽内测版细节粗糙,但大框架已现。它先匹配设计风格,再创建执行计划,还支持二次编辑等,集成多工具可生成视频等,未来或重写设计工作流。
11篇顶会论文之外,美图影像研究院做了一件事:让大众爱用AI
过去两年,AI 生成图片、视频变得容易,但让 AI 理解并按创作者意图创作很难。美图影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。