超低延迟」共找到 3024 篇相关文章

算法论文8

华为树HTP:不写示例、不调PDDL,AI规划约束通过率飙升62.6%

文章介绍华为树HTP,它是完全自主、可泛化的推理新范式。能让LLM在树结构上完成规划,不依赖人工示例和外部规划器,在复杂规划benchmark上实现SOTA准确率并降token成本,还阐述其原理、创新点及应用实例。

CourseAI
开源动态8

牛!小米开源「音频语言模型」,1亿小时预训练时间,音频理解和输出能力是真顶!

小米推出开源音频语言模型MiMo - Audio,有1亿小时预训练时间。它能理解音频,70亿参数模型在多基准测试达SOTA,音频理解Gemini - 2.5 - Flash,复杂推理优于GPT - 4o - Audio,还支持多模态任务。

开源AI项目落地
新闻资讯7

独家|拿下5亿元海外订单,无界动力完成天使++轮融资,天使轮累计融资2亿美元

AI科技评论独家获悉,通用具身智能机器人公司无界动力完成天使++轮融资,累计2亿美元,天使+++轮也接近完成。其以隐空间世界模型构建具身大脑,区别于主流架构。还获远景5亿订单,商业化落地成果多。

AI科技评论
算法论文8

华为CloudMatrix重磅论文披露AI数据中心新范式,推理效率NV H100

华为发布60页重磅论文,提出下一代AI数据中心架构Huawei CloudMatrix及产品CloudMatrix384。它架构设计独特,性能高效准确灵活,打破算力、延迟和成本“不可能三角”,重新定义AI基础设施。

量子位
开源动态7

Claude时代终结?LMArena实测DeepSeek R1编程得分Opus 4,但月暗称其新模型更胜一筹

在闭源模型主导的AI环境下,开源的DeepSeek - R1(0528)在LMArena测试中表现亮眼,编程得分Claude Opus 4,引发社区关注与讨论。不过LMArena曾被指责偏袒,其联合创始人反驳。此外,月之暗面新模型Kimi - Dev - 72B编程成绩R1。

AI前线
新闻资讯8

Meta华人新秀毕树,重磅爆料下一代LLM路线!RL+预训练直通AGI

OpenAI前研究员、Meta成员毕树在哥大演讲指出,AGI需高质数据、好奇驱动探索与高效算法,Scaling Law有效,规模决定智能,终身学习是重点,还探讨了AGI面临的诸多问题与挑战。

新智元
产品应用8

4K-Agent:可将分辨率图像提升至4K高清智能体

图像分辨率技术在多种视觉任务中重要,但传统方法泛化能力有限。德克萨斯A&M等大学研究人员推出4K Agent,其多智能体架构能将分辨率图像提至4K高清,在多领域测试表现出色。

AIGC开放社区
开源动态8

苹果端侧AI两连发!模型体积减半、首字延迟降85倍,iPhone离线秒用

苹果在Hugging Face放出FastVLM与MobileCLIP2两条多模态主线。前者主打「快」,首字延迟压到竞品1/85;后者突出「轻」,体积减半。模型和Demo已开放,开发者可集成开发。

新智元
开源动态7

Sora 模糊视频有救了!强大的免费开源AI视频处理工具!硬件要求

Video2X-QT6是免费开源AI视频处理工具,支持视频清放大、补帧,兼容CPU和GPU,配置电脑也能用。6.0.0版本用C/C++重写,速度快、跨平台,还能处理图片。介绍了不同系统安装方法等。

GitHubStore
产品应用8

阿里发布首个「音视频实时交互」模型,实现数字人实时视频聊天

阿里发布原生流媒体端到端模型Wan - Streamer v0.1,能实时聆听、观看、思考、说话和响应视频。它在单个Transformer内完成感知等操作,延迟,具备端到端多模态统一、延迟等特点。

开源AI项目落地