语义动作流」共找到 610 篇相关文章

算法论文8

动作分块突破RL极限,伯克利引入模仿学习,超越离线/在线SOTA

如今强化学习在多领域成果显著,但在长跨度、稀疏奖励任务中表现欠佳。加州大学伯克利分校研究者提出Q - chunking方法,将动作分块引入基于时序差分的强化学习,解决探索效率和值传播问题,实验表现优异。

机器之心
开源动态8

阿里巴巴 & 蚂蚁 LoongSuite GenAI 可观测语义规范:从统一数据语言到规模化落地

随着GenAI发展,OpenTelemetry推动语义规范建设。阿里巴巴与蚂蚁联合推出LoongSuite GenAI SemConv,在OTel基础上增强,新增Entry/Step Span、Skill语义、Token级推理观测,还推出GenAI Utils简化插桩开发。

阿里云开发者
算法论文8

刷榜自动驾驶语义场景补全!北大新作:高维度、高密度 | AAAI'26

北京大学彭宇新教授团队提出视觉语义场景补全方法HD² - SSC,通过高维度语义解耦和高密度占用优化,解决现有技术维度与密度差异问题,在两自动驾驶数据集上取得最优性能。

新智元
开源动态7

国内首套:港中文团队发布7模态人体动作数据集,揭开大模型理解能力短板

港中文邢国良教授团队博士生蒋思阳完成 CUHK-X 多模态人体动作数据集,成果被 ACM MobiSys 2026 接收。用其测试主大模型,发现理解人类动作平均正确率仅四成。该数据集数据收集方法反常规,还开展了基准测试。

DeepTech深科技
算法论文8

CJA | 中国航天气动院冯亦葳、许亮等:符号回归启发的可压缩场结构智能识别:基于局部对特征分布的统一理论框架

目前场结构识别方法有局限,传统经验法依赖阈值,深度学习法可解释性与泛化能力不足。本研究从体控制方程出发,用符号回归建立统一场结构分类框架,能准确识别复杂动结构。

力学与人工智能
算法论文7

InfiniteTalk:音频驱动的从口型到全身动作同步方法

近年来视频AIGC推动音频驱动人体动画变革,但传统视频配音局限口部。中国科学院大学提出稀疏帧视频配音范式,推出InfiniteTalk生成器,结合多种技术实现全身动作与音频同步,实验表现突出。

带你学AI
新闻资讯7

马斯克宣布用户将可语音定制X信息

埃隆·马斯克宣布11月X平台算法将由AI驱动,开源代码会持续更新,用户能语音定制信息。此计划引两极反应,算法也有缺陷,还面临可信度和信息茧房等问题。

AI工程化
新闻资讯8

刚刚!AI 圈顶 Karpathy 三连击:开源、泼冷水、AI 教育~

10月,AI圈顶Andrej Karpathy有三连动作:开源nanochat项目,100美元可复刻ChatGPT;发表AGI十年论,给行业泼冷水;推进Eureka教育项目,重构AI教育范式。

PaperAgent
算法论文8

模仿学习新范式!Chain-of-Action:轨迹自回归实现动作推理

具身智能领域尚未迎来「GPT时刻」,现有模仿学习范式有缺陷。字节跳动与阿德莱德大学研究者提出「动作链」(CoA)策略,通过轨迹自回归建模解决累计误差,提升泛化性,实验效果显著。

机器之心
算法论文7

GraphRAG还在持续进化,FlowRAG让证据链自己起来

上海AI Lab和华东师大论文提出FlowRAG,它是GraphRAG变体,把RAG检索从按相似度排文本块推向沿证据找推理路径。在多数据集上表现不错,虽平均Relevance低于LinearRAG,但更能保证证据链完整。

PaperAgent