「语义动作流」共找到 612 篇相关文章
登顶Hugging Face论文热榜,LLM重写数据准备的游戏规则
企业数据团队面临数据准备难题,传统方法依赖人工规则,有诸多局限。上海交通大学等机构研究团队综述指出,LLM正推动数据准备从“规则驱动”向“语义驱动”转变,还给出技术选型、评估基准及工程指南。
波士顿动力泯然众人了,高管集体出走,机器人“量产”只能造4台
波士顿动力放出新版Atlas机器人新demo,其完成高难度体操动作。此为2026年初CES展示的量产版,主打企业级应用。但上市前夕高管集体出走,且Altas月产量仅4台,引发对其前景的质疑。
CuteDSL-2: 基本操作
文章为Cute - DSL第二篇,整理官方notebook介绍基本操作。涵盖数据类型、张量、结构体等基本操作,还介绍了控制流(For、If - Else、While循环等)及TensorSSA的相关操作,如LD/ST、运算、切片等。
谷歌深夜放出「创世引擎」Genie 3!一句话秒生宇宙,终极模拟器觉醒
谷歌DeepMind推出通用世界模型Genie 3,能以每秒20 - 24帧速度实时生成720p画面,一句话即可生成动态世界,可模拟物理、自然等多种场景,但也存在有限动作空间等局限。
让本地大模型不再重复推理的缓存技巧
本地跑大模型时,同样问题换说法问,模型又要重新推理。`constraint-cache`这个Python库可解决此问题,它将语义相似查询规范化为统一缓存键,实现近乎即时的重复查询响应,还避免了随机性响应问题。
比自回归更灵活、比离散扩散更通用,首个纯Discrete Flow Matching多模态巨兽降临
近年来多模态大模型多采用自回归架构,推理缺乏灵活性。香港大学和华为诺亚方舟实验室研究团队提出FUDOKI,基于全新非掩码离散流匹配架构,能并行去噪、动态修正,为多模态模型开辟新路径。
JCP | 中科院力学所孙振旭研究员团队:关于物理信息神经网络的预处理:如何在流体力学中更好地利用数据
物理信息神经网络(PINNs)为求解微分方程正反问题提供灵活框架,但数据预处理领域待探索。本文提出数据预处理方法,通过对数据和方程归一化,在四个湍流案例中提升PINNs流场重建预测准确度,不增计算成本。
DeepSeek出品,必是精品!DeepSeek-OCR 2发布:让LLM像人一样读懂复杂文档,效果超Gemini 3 Pro
DeepSeek推出DeepSeek-OCR 2,提出“视觉因果流”,以全新视觉编码器赋予模型因果推理能力。它在文档解析基准表现超Gemini 3 Pro,代码和模型权重已开源,为2D推理和原生多模态探索铺路。
阿里千问你别太荒谬!连漫画PPT都能一键生成?我以前那些夜真是白熬了
阿里千问发布AI PPT生成工具Qwen AI Slides,从内容结构到视觉配图全包。实测显示,其语义理解能力不错,文本渲染在简单字体表现好,排版有小瑕疵,适合课堂展示等场景。
世界首个「实时、无限」扩散视频生成模型,Karpathy投资站台
Decart发布世界首个「实时、无限」扩散视频模型MirageLSD,输入视频流能快速转化画面,前特斯拉AI总监Karpathy投资。它在时长和延迟上有突破,也有需改进之处。