流处理架构」共找到 2822 篇相关文章

新闻资讯8

谷歌发布AP2协议,联手PayPal放大招:AI要自己下单了

2025年9月17日,谷歌推出智能体支付协议AP2并开源,宣布与PayPal战略合作。AP2通过‘授权令牌’解决AI下单信任问题,设计三种场景令牌,还采用角色架构保证安全,谷歌联合超60方搭建生态。

AIGC开放社区
算法论文8

用2D数据解锁3D世界:首个面向运动学部件分解的多视角视频扩散框架

张昊等提出 Stable Part Diffusion 4D (SP4D) 框架,由 Stability AI 与 UIUC 联合完成。它能从单目视频生成多视角 RGB 与运动学部件序列,解决运动学部件分解及自动 rigging 问题,实验效果显著,被 Neurips 2025 接受为 Spotlight。

机器之心
产品应用8

这一次,天玑9500的端侧AI能力,友商赶不上了

9月22日,联发科推出天玑9500芯片,展示新形态端侧AI应用,推动端侧AI实用化。其性能强、功耗低,还支持端侧模型训练。多家手机厂商将发布搭载该芯片的手机,展现新AI趋势。

机器之心
开源动态8

表格理解新纪元!上交大等联合开源,半结构化表格问答准确率提升40%!

数据密集型工作中半结构化表格处理难,传统工具和GPT - 4o表现不佳。上海交通大学等联合开源ST - Raptor,通过VLM、HO - Tree算法和LLM推理,解决复杂表格问答问题,支持多格式,适用于多场景。

开源星探
产品应用7

实测国内首个对话式AI音乐创作Agent:聊个天就能谱曲填词混剪生成MV

实测国内首个对话式AI音乐创作Agent Tunee,玩法像Suno+ChatGPT结合体。它操作简约功能全,能反复修改创作,还具备多模态内容处理能力,虽有小瑕疵,但体现国产AIGC应用发展趋势。

量子位
算法论文8

AI在实时视频里秒“剪”出你想要的部分!输入文字/图/视频片段,它都能秒懂|ICCV2025

最新混合模态在线视频定位技术OVG - HQ开挂了!它能根据文字、图、视频片段等线索,在实时视频中精准裁剪出关心的事件,已收录于ICCV2025,破局以往技术“离线”“词穷”缺陷。

量子位
算法论文8

国科大 | 提出进化算法:EvolKV,自适应分配KV Cache,预算降至1.5%!

键值缓存(KV cache)是大模型快速运行核心技术,但输入文本越长,存储和处理问题越突出。国科大提出进化算法EvolKV,自适应分配KV Cache,实验显示其效果显著,预算可降至1.5%。

AINLPer
算法论文8

具身VLA后训练:TeleAI提出潜空间引导的VLA跨本体泛化方法

现有VLA基座模型能力不足,跨本体适配存在挑战。中国电信人工智能研究院具身智能团队提出“对齐 - 引导 - 泛化”(ATE)框架,实现从调架构到调分布的范式转移,适配主VLA模型,减少数据需求。

机器之心
算法论文8

空间智能新高度:港科大谭平团队SAIL-Recon突破万帧级图像大规模3D场景重建Transformer

香港科技大学谭平教授团队与地平线团队发布3D场景表征与大规模重建新方法SAIL - Recon,突破现有模型处理能力瓶颈,可实现万帧级场景表征抽取与定位重建,在多数据集上表现优于现有方法。

机器之心
算法论文7

基于离散扩散模型的高效音频修复方法

数字音频时代音频易损坏丢失,传统修复法处理长间隙不佳。本古里安大学研究人员提出基于离散扩散模型的音频修复法,经MusicNet数据集实验验证,该方法在各间隙长度上表现优异。

AIGC开放社区