「问题生成」共找到 4986 篇相关文章
长篇动画上色稳如老狗!全新开源LongAnimation
动画上色是制作长篇动画时“烧脑”又“烧钱”的环节,现有AI主流方法多为局部处理,易导致色彩漂移、风格不统一。中国科学技术大学团队提出动态全局 - 局部范式,构建LongAnimation框架,可确保长动画色彩一致。
Gemini负责人爆料!多模态统一token表示,视觉至关重要
Gemini模型行为产品负责人Ani Baddepudi与谷歌AI Studio产品负责人探讨Gemini多模态技术,涉及设计理念、应用及发展方向。指出多模态对构建AGI重要,还介绍Gemini 2.5视频理解亮点与‘万物皆视觉’理念。
老黄预言成真!全球首个AI原生游戏引擎,一句话秒出GTA级神作
谷歌、英伟达等八大机构联手发布全球首款AI原生UGC游戏引擎Mirage,无预设关卡,一句话即生游戏。它以实时交互‘世界模型’为核心,玩家可随心创造,体验远超传统游戏。
揭秘 GitHub 11.1k 让你的存储秒变“万能盘”?JuiceFS:最好用的存储系统能为你带来怎样革命性的提升?
云存储成本高、性能差等问题让人烦恼,JuiceFS 可零代码改造,将对象存储升级为高速共享文件系统。它功能丰富、架构有优势,代码示例简单,适用于多场景,相比竞品优势明显。
端侧AI加速到来,个人隐私如何保护?
Deepseek推动端侧AI加速落地,苹果、谷歌等企业纷纷布局。不过,端侧AI在发展中面临融合不佳、数据安全等问题。阿里研究院傅宏宇提出保障数据安全的建议,监管层也出台相关法规。
时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8
在大语言模型发展中,Transformer自注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。
ACL 2025 | 大语言模型正在偷改你的代码?
本文聚焦大语言模型在代码推荐中的「供应商偏见」,通过分析7个主流大模型在30个场景的59万次响应,发现模型会偏好特定供应商,甚至擅自修改代码,还探讨了风险、局限并给出展望。
DeepMind 最新研究:智能体就是世界模型!
DeepMind研究科学家Jon Richens团队在ICML 2025发表论文,从第一性原理证明智能体就是世界模型,回答了AI界多年的根本问题,还带来多个有趣推论,引发AI社区热烈讨论。
0粉丝狂卷数十亿播放,靠AI流量欺诈获利近亿!网友:这“刑”得离谱
2024年全球录制音乐市场总收入飙升,流媒体经济贡献突出,但AI技术引发的流媒体欺诈问题严峻。如北卡罗来纳州男子Michael Smith利用AI创作虚假歌曲欺诈获利,类似事件增多,平台反击成效不佳。
音频大模型安全可信度的全面“体检”!6大维度,清华南洋理工联手打造
南洋理工和清华团队提出新框架AudioTrust,将ALLMs评估扩至六个核心维度,探究音频模态特有问题。目前基准及平台已开发,揭示了开源与闭源ALLMs在多维度的潜在风险。