逐场景方案」共找到 2628 篇相关文章

算法论文8

盛大AI研究院新作:流式生成超越非流式,一句话让虚拟人动作丝滑如真,推理延迟仅1帧

盛大AI研究院与东京大学联合提出FloodDiffusion,首个基于定制化扩散强制的流式人体动作生成框架。它能零延迟生成无限长动作序列,解决了现有方法的问题,在多数据集评估中表现优异。

量子位
产品应用8

牛B, 我去,新手小白也能使用InfiniteTalk搭建属于自己的数字人啦 ,真的太简单啦!!!

文章聚焦InfiniteTalk,剖析数字人视频制作痛点,阐述其以“稀疏帧视频配音”破题,具备无限长度、全身与表情同步等优势,介绍核心功能、使用方法,对比同类项目,凸显其多方面优越性。

小华同学ai
算法论文8

细粒度视觉推理链引入数学领域,准确率暴涨32%,港中文MMLab打破多模态数学推理瓶颈

香港中文大学MMLab团队发布MINT - CoT视觉推理方案,解决多模态数学推理难题。它引入特殊Interleave Token,构建专属数据集,采用三阶段训练策略,实验效果全面超越现有方法。

量子位
产品应用8

一个大脑,多种本体:江行智能详解物理AI工业落地的系统解法

在2026世界机器人大会具身智能商业落地论坛上,江行智能CEO庞海天演讲指出,物理AI落地受算力约束,中国工业物理AI靠工程效率。江行提出‘一脑多体’架构,产品适配多场景,真实场站成果佳。

机器之心
开源动态8

EdgeClaw:把 Claude Code 体验带到 OpenClaw

EdgeClaw 由清华、人大、面壁智能联合打造,是开源 AI 助手。它让 OpenClaw 用户拥有 Claude Code 级长期记忆能力,有多层结构化长期记忆等核心功能,适用于大型代码库维护等场景,还给出了使用方法。

小华同学ai
新闻资讯7

Cloudflare 构建了面向 LLM 的高性能基础设施

Cloudflare发布全新基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示词缓存优化方案

InfoQ
算法论文8

结构化扩展拿下Agent工具检索新SOTA,精准找到API|ICLR'26

宁波东方理工大学沈晓宇团队在ICLR 2026发表论文,指出当前工具检索瓶颈在于工具文档。提出对文档结构化扩展,再训练模型的方案,构建TOOL - REX等组件,实验显示显著提升检索性能。

量子位
产品应用8

告别JSON冗余:TOON让Token成本降低30-60%

LLM交互用JSON有冗余,成本高、速度慢。TOON格式专为LLM优化,结合YAML和CSV特点,比JSON减少30 - 60%的token消耗,还介绍了特性、上手方法、集成实践和适用场景

CourseAI
开源动态8

不看后悔!GitHub 开源 MultiTalk .8k star 强大的人语音+图像绑定项目

MultiTalk 是 MeiGen‑AI 开发的开源框架,可从音频、图片和提示语生成多人对话视频。它解决传统视频制作痛点,功能亮点多,技术优势明显,应用场景广,与同类项目对比表现突出。

小华同学ai
产品应用8

业内首推“共享存储”,OceanBase何以办到?

5月17日,OceanBase在开发者大会推出“共享存储”产品,实现对象存储与事务型数据库深度集成,降低存储成本、提升弹性。它解决了传统架构瓶颈,靠多项技术创新落地OLTP生产环境,适用于多业务场景

InfoQ