视频时长预测」共找到 1957 篇相关文章

算法论文8

让AI作画自己纠错!随机丢模块就能提升生成质量,告别塑料感废片

来自清华、阿里等的团队推出S² - Guidance方法,通过随机丢弃网络模块动态构建子网络实现自我修正。它避免了其他方法繁琐调参,在文生图和文生视频任务中显著提升生成质量与连贯性,且计算高效。

量子位
新闻资讯8

一图看透全球大模型!新智元十周年钜献,2025 ASI前沿趋势报告37页首发

新智元十周年峰会发布《2025新智元ASI前沿趋势报告》与《2025新智元ASI产业图谱》,预测2027达ASI临界,智能体全面爆发。报告展示全球大模型格局,中国开源模型表现亮眼,还揭晓了创新大奖。

新智元
新闻资讯8

Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!

隔5个月,xAI发布通用模型Grok 4,后续还将推编码、多模态代理和视频生成模型。Grok 4已上线,有三个订阅版本。马斯克称其智能超博士生,在多基准测试中领先,编码或超Cursor。

InfoQ
算法论文8

ICML 2025 | 无需训练,即对齐大模型偏好

上海人工智能实验室提出TPO方案,可让大模型在推理快速对齐人类偏好,无需更新模型权重。TPO类似文本形式的梯度下降,在多个基准数据集评测中表现出色,还提供“宽深结合”推理拓展策略。

深度学习自然语言处理
新闻资讯7

狂奔AGI,Claude年终封王!自主编码近5小震惊全网

METR报告称Claude Opus 4.5能持续自主编码5小,超OpenAI最强编程模型。AI编码智能体任务长指数级增长,不过迈向AGI仍面临长期记忆难题,未来一年该领域或有突破。

新智元
新闻资讯7

刚刚,Google Veo 3.1 发布,Sora 还香吗?

Google 发布 Veo 3.1,重新定义 AI 视频生成天花板。它对叙事深度理解,新增音频生成,有四大核心能力。网友将其与 Sora 2 对比,二者各有千秋。还介绍了 Veo 3.1 使用方式及 Flow 平台成果。

AGI Hunt
新闻资讯7

实测GPT-5:写作坠入谷底,编程一骑绝尘。

GPT-5发布,它是统一系统,含多种模型。性能上减少事实幻觉、应对谄媚有进展,跑分强且节能,但无新功能特性。写作不如GPT 4.5,编程表现出色,发布后OpenAI与Google预测交叉跳水。

AI大模型应用实践
开源动态8

1.2K Star!终于有工具开始认真解决 AI Agent 安全问题了!

作者深度使用AI Agent担忧其安全性,GitHub上斗象科技开源的ClawVault项目,上线不久获1.2K Star。它为AI Agent提供多场景安全隔离方案,有分格管理、可视化监控等实用设计,适配Python3.10+环境,安装方便。

开源星探
新闻资讯7

HBM之父:HBM的终点是HBF

韩国SK海力士宣布完成HBM4开发,它将成数据中心和AI芯片首选。HBM4有出色数据处理速度和能效,应用后AI服务性能或提升69%。HBM之父金正浩教授预测,未来HBF将取代HBM,还提出金氏定律指导行业发展。

芯师爷
算法论文8

大模型如何"不训练"也能学习?——上下文学习的隐式权重更新机制

大型语言模型能通过上下文学习(ICL)在推理学习新任务,无需修改模型参数。本文首次证明自注意力层与MLP层组合能隐式将上下文信息转为MLP层低秩权重更新,解释了ICL原理,为构建AI系统开辟新路径。

深度学习自然语言处理