分镜控制」共找到 1074 篇相关文章

算法论文8

对抗KV Cache压缩的脆弱性:两行代码以最坏风险控制防御底层假设崩塌

中科大团队在 ICLR 2026 论文中指出 KV Cache 压缩领域底层假设存在缺陷,主流方法基于的稳定性假设在真实场景中脆弱。团队提出防御性聚合策略,仅两行代码修改,显著提升 KV Cache 压缩性能。

机器之心
8

龙虾“黑入”卡帕西家的智能家居系统:本来需要控制六个软件,现在用WhatsApp就能操控

特斯拉前AI总监卡帕西做客播客,享诸多AI观点。如编程成个人能力问题,可让AI写代码;用龙虾打理智能家居,整合多软件;还谈及autoresearch、模型能力断层、模型化、开源闭源格局等内容。

量子位
算法论文8

突破长视频生成瓶颈:南大、TeleAI推出全新AI生成范式MMPL,让创意一到底

当前AI长视频生成面临质量骤降、细节崩坏、生成低效等问题。南京大学联合TeleAI推出MMPL新范式,首创“宏观规划、微观执行”双层生成架构,实现钟级高质量长视频稳定生成,效率显著提升。

机器之心
新闻资讯7

毕业7年,身价破亿!清北AI天团血洗硅谷,奥特曼被逼天价股份

清北中科等名校毕业生在硅谷成超级明星,谷歌因Meta挖人给员工涨薪,OpenAI为留人给部员工加薪、送1/3股权。AI人才薪资差距大,国内AI人才也多出身名校,需求和高薪职位增长快。

新智元
产品应用8

AI无限生成《我的世界》,玩家动动键盘鼠标自主控制!国产交互式世界模型来了

昆仑万维带来交互式世界模型Matrix - Game,可让用户用键鼠探索创作虚拟内容。它发布了Matrix - Game - MC数据集、主模型和GameWorld Score评测体系,在多项评测中领先,还能在多领域发挥作用。

量子位
算法论文8

大模型再爆弱点!旧记忆忘不掉,新记忆不出,准确率暴降 | ICML'25

弗吉尼亚大学和纽约大学研究人员用「前摄干扰」概念设计测验PI - LLM,测试大语言模型(LLM)上下文检索能力。结果显示,随干扰增加,模型准确率对数下降至零,提示工程效果有限,需调整模型架构或训练范式。

新智元
产品应用7

Git 是给工程师的,YoYo 是给 Vibe Coders 的!网友:“这才是 AI 时代的版本控制!”

大家常用的Git用于交付最终产品,适合工程师。但编码探索过程混乱,这正是YoYo要解决的问题。它能捕捉凌乱试验,核心功能有保存、预览、恢复,还支持代理AI搜索,适配主流IDE。

AI进修生
新闻资讯8

全球顶尖大模型一夜惨遭血洗!最难测试人类拿满,AI第一名得0.2%

全球最难AGI测试ARC - AGI - 3上线,人类满通关,最强模型Opus 4.6仅得0.2%。测试从静态题变为互动游戏,评看效率。前沿大模型得低,非LLM方案表现更好,AI缺乏元认知能力。

新智元
开源动态8

52KB 的奇迹!NovaSR 开源:16kHz 秒变 48kHz,快出天际的音频超模型!

在AI“巨物崇拜”盛行时,NovaSR开源带来“微型震撼”。它仅52KB,能将16kHz音频提至48kHz,单张A100达3600倍实时。可端侧运行,效率提升显著,有诸多应用场景。

开源星探
新闻资讯7

危险?OpenAI 模型行为负责人:人类很快会进入「AI意识」,当前最重要是控制人机关系的影响

OpenAI模型行为与政策负责人Joanne Jang发文指出,与其争论AI是否有意识,不如关注其对人类“情感福祉”的影响。文章探讨了OpenAI在人机关系上的处理,以及如何塑造模型行为,还提及未来计划。

AI寒武纪