模长感知」共找到 953 篇相关文章

算法论文8

突破视觉-语言-动作型的瓶颈:QDepth-VLA让机器人拥有更精准的3D空间感知

视觉 - 语言 - 动作型(VLA)在机器人操控领域潜力大,但应对时序或精细操作任务时性能下降,根源是缺乏三维空间感知与推理能力。中国科学院自动化研究所与灵宝 CASBOT 提出 QDepth - VLA 型,提升了机器人空间推理与操控精度。

机器之心
产品应用8

面壁MiniCPM4端侧型发布:文本推理 5 倍提速,0.5B 型拿下新SOTA

2025智源大会,面壁发布MiniCPM4.0端侧型,含8B稀疏闪电版与0.5B款。其采用InfLLM架构,实现文本推理5倍提速、最高220倍加速,还在性能、部署等方面优化,适配多芯片与框架。

AI科技大本营
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现大型高效端到端时记忆

机器之心发布文章介绍,大期记忆能力受限于上下文度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M度的大时记忆框架。

机器之心
新闻资讯7

AI Agent 是期运行的“风险系统”,如果你还只在防 Prompt Injection,说明已经落后一代了

AI安全公司CyberArk首席软件架构师Niv Rabin团队提出基于“指令检测”与“历史感知校验”的方法,防御大语言型和AI Agent恶意输入与历史投毒攻击,介绍多种防御机制。

InfoQ
开源动态8

国产类脑大型适配国产沐曦GPU!序列推理提速超百倍,仅用2%数据匹敌主流

中国科学院自动化所李国齐、徐波团队发布类脑脉冲大型SpikingBrain (瞬悉)-1.0,借鉴大脑信息处理机制,适配国产沐曦GPU,序列推理提速超百倍,仅用2%数据匹敌主流型,探索构建国产自主可控类脑大型生态。

量子位
产品应用8

文本推理 5 倍提速!面壁MiniCPM4 端侧型发布,0.5B型效果秒杀同级

近日,面壁发布 MiniCPM4.0 端侧型,有 8B、0.5B 两种规。其在基准测试表现出色,文本推理提速,缓存锐减,还做了架构创新。此外,面壁有自研推理框架,科学化建产线,6 月 27 - 28 日 AICon 北京站将探讨 AI 趋势。

AI前线
产品应用8

大神Karpathy都投的AI实时视频生成型:直播都能立即转,无限时几乎零延迟

AI初创公司Decart推出首个零延迟无限实时视频生成的AI型MirageLSD,大神Karpathy都投资了。它能实时生成视频流,无时限制且延迟低至40毫秒以下,还攻克了传统型‘误差累积’难题。

量子位
开源动态8

李飞飞50亿美金赛道被开源!浙大教授章国锋带队创业,打造无限时实时3D世界

2024年李飞飞创立的World Labs入局空间智能赛道,估值达50亿美元。近日影溯发布并开源实时帧生成型InSpatio - WorldFM,由章国锋领衔,该型突破2D局限,效率高、能无限时推理,展现出高工程可用性。

机器之心
8

刚刚!Kimi Linear横空出世,全新注意力架构:1M文本解码速度飙升6.3倍,KV缓存砍掉75%

月之暗面推出全新注意力架构Kimi Linear,有望成下一代Agent LLM基石技术。它解决了LLMs处理序列任务的瓶颈,性能超传统机制,还开源了核心代码。Kimi Linear的KDA块提升了表达和硬件效率,实验表现佳。

AI寒武纪
算法论文8

视频世界型跑序列不「崩」了!用光流约束+历史记忆+多步训练,让动态场景稳如磐石

现有视频世界型在时间交互中易出现运动不合理与场景崩坏问题,核心原因是误差累积。MagicWorld提出面向时稳定性的交互式建框架,通过光流约束、历史缓存检索和多步聚合训练,有效缓解误差累积。

量子位