实时长视频」共找到 1782 篇相关文章

算法论文8

Meta「分割一切」3.0曝光!技能语义分割加入概念提示,好好玩,要爆了

Meta第三代“分割一切”模型SAM 3悄然投稿ICLR 2026。它支持基于概念提示的多实例分割,能听懂人话,处理图片快,还设计新架构、构建数据引擎、提出SA - Co基准,实验表现佳但也有局限。

量子位
产品应用8

这一次,天玑9500的端侧AI能力,友商赶不上了

9月22日,联发科推出天玑9500芯片,展示新形态端侧AI应用,推动端侧AI实用化。其性能强、功耗低,还支持端侧模型训练。多家手机厂商将发布搭载该芯片的手机,展现新AI趋势。

机器之心
算法论文8

国科大 | 提出进化算法:EvolKV,自适应分配KV Cache,预算降至1.5%!

键值缓存(KV cache)是大模型快速运行核心技术,但输入文本越,存储和处理问题越突出。国科大提出进化算法EvolKV,自适应分配KV Cache,实验显示其效果显著,预算可降至1.5%。

AINLPer
算法论文7

基于离散扩散模型的高效音频修复方法

数字音频时代音频易损坏丢失,传统修复法处理间隙不佳。本古里安大学研究人员提出基于离散扩散模型的音频修复法,经MusicNet数据集实验验证,该方法在各间隙度上表现优异。

AIGC开放社区
算法论文8

仅需152个样本,性能提升48%:Memory-R1如何重塑Agent记忆能力?

这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。

深度学习自然语言处理
7

月烧35万元token、逼得Claude官方连夜限速!被全网吐槽的中国“榜一大哥”,已经靠 AI 年入千万了

X 用户“刘小排”认领月耗 5 万美元 Claude Code token。他靠 AI 年入近千万,用 AI 开发产品,还分享找需求、做产品等经验。他认为 AI 是期机会,能放大个人能力。

InfoQ
推荐文章7

对谈 Memories AI 创始人 Shawn: 给 AI 做一套“视觉海马体”|Best Minds

本文是对 Memories AI 创始人 Shawn 的访谈。他指出当下 AI 记忆多为“上下文工程”,其团队致力于打造视觉记忆层 LVMM。还探讨了视觉与文本记忆区别、LVMM 架构及应用场景等,认为视觉记忆将成下一代 AI 核心。

海外独角兽
产品应用7

你的数字伴侣贝拉 (Bella),正在唤醒!

贝拉是数字伴侣种子,愿景是成用户持久个性化伙伴。早期通过轮播视频呈现,采用AI原生开发路径,分感知核心、生成式自我、主动式陪伴三阶段构建,目标是成为由AI驱动的生命体。

GitHubStore
开源动态8

基于闪电注意力机制,创新高效开源大模型

传统Transformer架构处理文本和复杂推理任务有效率瓶颈,多数领先模型仍依赖传统注意力设计。MiniMax开源基于闪电注意力机制的专家混合模型Minimax,从架构、创新模块、训练框架等多方面优化,表现突出。

AIGC开放社区
产品应用8

千卡集群破壁之道:vivo视觉多模态大模型训练效率跃迁实战

多模态大模型在多领域需求增,但千卡级 GPU 训练挑战大。vivo AI 架构师王兆雄在大会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。

InfoQ