「HLS视频背景」共找到 1126 篇相关文章
LightX2V Ulysses Attention 实现学习笔记
本文记录了LightX2V中Ulysses Attention的实现方式与张量形状推导。在多模态/视频场景,其实现可概括为一种layout变换,还提供`enable_head_parallel`和`use_fp8_comm`选项,效果受运行环境等因素影响。
AAAI 2026|AP2O-Coder 让大模型拥有「错题本」,像人类一样按题型高效刷题
在AI辅助Coding技术发展背景下,开源大语言模型生成代码有运行错误。上交博士团队提出AP2O方法,构建AP2O - Coder框架,借鉴人类学习模式,经实验验证能提升模型性能、抑制错误、提高样本效率,还适配通用模型。
“不是...而是...”刷屏的一年,我读内容的快乐被AI偷走了。
作者补完《怪奇物语》后看B站解说视频,因文案中“不是...而是...”句式不适,由此探讨人们讨厌AI生成内容的原因,指出其像新时代八股文,还提及全球对AI内容的不信任,呼吁保持与他人的真实连接。
国产GPU双雄竞速,大佬葛卫东再赴资本盛宴
“国产GPU第一股”争夺正酣,继摩尔线程后,沐曦股份科创板IPO过会,估值达210亿。其创始人陈维良背景深厚,产品量产快。私募大佬葛卫东多次下注,收益接近翻倍。但国产GPU研发风险高,谁能抢占先机待察。
AI安全上,开源仍胜闭源,Meta、UCB防御LLM提示词注入攻击
Meta和UCB开源安全大语言模型Meta - SecAlign - 70B,其对提示词注入攻击鲁棒性超闭源方案,还具更好的agentic ability。介绍了提示词注入攻击背景、防御方法,该模型打破闭源垄断,开源代码助力安全AI建设。
一文看懂“提示词” vs “提示词工程” vs “上下文工程”
文章区分了提示词、提示词工程和上下文工程的概念。提示词是给AI模型的输入文本;提示词工程是设计、测试、优化提示词的过程;上下文工程是为大模型构建动态上下文的学科,在AI Agent背景下诞生。
LeCun亲自出镜打脸质疑者!憋了20年的AI世界模型,终于爆发了
LeCun亲自出镜介绍V-JEPA 2新进展,目标是开发改变AI与物理世界交互的世界模型。V-JEPA 2基于视频训练,有两阶段训练细节,能用于机器人规划,Meta还发布三个基准测试,后续将研究分层和多模态JEPA模型。
10 天 3000 元,一人造出全球 AI 爆款!好莱坞导演抢人、游戏版引爆期待,合作细节首次披露
中国 29 岁中专毕业的 AI 视频创作者 Mx - Shell 用 10 天、3000 元成本做出 AI 短片《丧尸清道夫》爆火,海外 CEO 隔空递 offer。短片将推大银幕版,游戏版也在制作。Yoroll 创始人谈 AI 互动游戏赛道玩法、商业化等问题。
100年后 K8s 还会存在吗?创始人 Brendan Burns:它将像 Linux 一样消失在 AI 之下
Kubernetes联合创始人Brendan Burns在访谈中回顾其诞生背景,指出Google开源K8s是为掌握技术演进主导权。他认为K8s虽成事实标准,但也有上限,未来或如Linux般成底层系统,100年后难原封不动存在。
腾讯混元世界模型1.1开源:单卡秒级重建3D世界成为现实
腾讯混元团队开源混元世界模型1.1,它是混元3D世界模型1.0升级版。新增多视图及视频输入,单卡可部署,秒级创造3D世界。有核心突破,能处理多任务,经训练策略优化,多测试表现佳。