「数据延迟」共找到 2656 篇相关文章
人大-清华-腾讯发布:音频 - 视觉多模态任务统一框架
人大、清华和腾讯合作发布Crab论文,目标是实现多模态场景理解任务的高效一统。它针对音频 - 视觉理解模型难点提出解决方案,构建数据集、设计LoRA结构、统一架构,训练分预训练和指令调整两阶段。
首个面向柔性衣物灵巧操作的仿真平台来了,北大、伯克利联合发布
北大和伯克利联合发布首个面向柔性衣物灵巧操作的仿真平台 DexGarmentLab。它基于 Isaac Sim 4.5.0 搭建,有多样化场景、自动化数据采集管线和泛化能力强的策略框架 HALO,可推动柔性物体操作应用。
Meta 开源 Brain2Qwerty v2:非侵入式脑机接口语句解码准确率达到 61%
Meta 近日开源非侵入式脑机接口系统 Brain2Qwerty v2,能将人脑想法解码为完整语句,平均单词识别准确率达 61%,远超其他非侵入式方案。其采用三阶段深度学习模型,代码和训练数据已公开。
这帮清华的,造了一个让龙虾“安全着陆”的新物种
在OpenClaw热潮中,隐私保护缺位成企业和开发者难题。无问芯穹推出InfiniClaw Box,独创‘三段式’架构,适配全模态信源,解决数据安全与模型能力兼顾问题,还与多家企业合作拓展应用边界。
Meta开源史上最强语音“基座模型”:一口气支持1600+种语言
Meta AI FAIR团队发布Omnilingual ASR模型套件,能为超1600种语言提供自动语音识别能力。它引入新架构提升性能,改变引入新语言范式,还发布相关数据集和模型,与全球伙伴合作。
编程通缩——当代码一天比一天便宜会发生什么
文章探讨编程通缩现象,即AI使软件开发成本等下降。它不同于传统通缩,由生产力提升驱动,会带来延迟与实验、质量两极分化等悖论,还会加速创新,人们应培养相应技能适应。
创始人不懂增长,团队再忙活也没用
文章指出很多创始人虽技术、团队出色,但对产品增长数据避而不谈。他们高薪招增长负责人却全权交托,自身缺乏增长认知,这在当下很危险。还提到 9 月 20 - 21 日将分享增长调研成果。
天下武功,唯快不破:LLM高效架构最新最全面综述
大型语言模型虽成就辉煌,但训练成本高、推理延迟大,核心问题源于Transformer架构。这篇综述论文首次系统性梳理高效LLM架构创新方案,分类七大类方法,延伸至跨模态应用,为研究者提供‘效率蓝图’。
微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行
今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。
谷歌Gemini杀入全球桶,血洗微软Office!颠覆全球3亿打工人
谷歌官宣Gemini全面升级版Workspace体验,全线接入Docs、Sheets、Slides。在SpreadsheetBench测试中成绩出色,谷歌Workspace更个性化实用。新功能覆盖文档、表格、幻灯片及云盘,还明确数据边界,欲定义下一代办公软件。