「点云视觉」共找到 1842 篇相关文章
隼瞻科技重磅发布DSA处理器敏捷开发平台ArchitStudio,引领RISC-V专用处理器设计革命
第五届RISC - V中国峰会,隼瞻科技发布DSA处理器敏捷开发平台ArchitStudio。它是全栈式平台,集成深厚技术积累,提供完整支持,能解决传统设计痛点,让开发敏捷高效,推动行业发展。
MIT团队完成AI控制人类行为实验项目
MIT团队的Human Operator项目是实时人体增强工具,也是MIT Hard Mode 2026获奖项目。它通过视觉 - 语言模型结合电刺激肌肉实现人体运动控制,介绍了技术栈、环境要求、软硬件准备、安装步骤等。
轻量级语音模型Vui开源,支持本地部署,笑声停顿全拟真,4万小时练出人类对话感!
近日,Fluxions - AI团队在GitHub开源轻量级语音模型Vui,可设备端运行。它能精准模拟语气词、笑声等,有三款模型,适用于语音助手、播客生成等场景,解决了传统模型的痛点。
刚刚,全球首台「万元级」高性能人形机器人诞生!比Mac还便宜
9月2日,全球首个万元级高性能人形机器人——元点机器人Zeroth Bridge「小桥」发布,极客版首发价8888元。它轻巧便携,性能强劲,支持全量二次开发,还发布了OpenBridge开发者全开源生态。
我在OpenAI修中文
OpenAI研究科学家陈博远介绍GPT Image 2官网博客花絮,分享模型训练、测试情况,还展示亲手制作的官网图片,包括中文彩蛋、漫画、杂志页等,体现模型文字渲染、视觉推理等能力。
牛B, 我去,新手小白也能使用InfiniteTalk搭建属于自己的数字人啦 ,真的太简单啦!!!
文章聚焦InfiniteTalk,剖析数字人视频制作痛点,阐述其以“稀疏帧视频配音”破题,具备无限长度、全身与表情同步等优势,介绍核心功能、使用方法,对比同类项目,凸显其多方面优越性。
LeCun力荐的JEPA杀入LLM,用CV的思路训练LLM,性能鲁棒性双丰收
LeCun团队提出LLM - JEPA,将JEPA自监督学习架构从视觉扩展到LLM。它能提升性能和鲁棒性,在多模型和数据集验证有效,但有训练开销大、泛化性不足等局限。
Github 23000+ star 又一神级开源项目,秒杀市面上主流收费产品,最主要是轻量化部署!!!
Focalboard 是一款开源项目,能解决团队协作和项目管理中任务杂乱、主流工具收费高、需私有部署等痛点。它功能丰富,适用于多种管理场景,支持本地部署,数据完全自控。
MiniMax海螺视频团队首次开源:Tokenizer也具备明确的Scaling Law
MiniMax海螺视频团队首次开源,揭晓视觉分词器难题答案。其推出的VTP框架可提升模型性能,解决传统Tokenizer缺陷,还展示了Tokenizer的Scaling Law,为行业提供新路径。
750篇论文,彻底把统一多模态模型摸清了
未来迈向AGI需多模态AI系统。南大等联合发表综述,涵盖754篇文献。分析传统路线痛点,介绍统一多模态模型定义、技术路线、训练方法等,还提及应用场景及未来方向。