「类脑视觉技术」共找到 3396 篇相关文章
成本下降 90%后,Figure 的下一步是机器人「自己造自己」?
近期,海外人形机器人公司 Figure 首席执行官 Brett Adcock 接受访谈,围绕「Figure 的核心技术与产品迭代」,就全栈端到端神经网络架构、数据壁垒与垂直整合等核心议题,阐述其通用人形机器人技术路线、产业逻辑与商业化实践。
Meta被骂跑偏后摊牌!Alex Wang回应新团队目标:个人Agent全球化部署,Manus已在应用上开路
Meta超级人工智能实验室(MSL)负责人Alexandr Wang发声,称其任务是推动超级智能技术突破并做成产品推向数十亿用户,要把个人Agent全球化部署,还谈到与研究和产品平衡、Meta的AI思路等问题。
多尺度特征融合:原理、结构与实用算法案例
文章介绍多尺度特征融合技术,它结合网络不同层次特征以捕获丰富上下文信息,在目标检测等任务广泛应用。阐述原理、常用方法,介绍FPN、U - Net等结构,并给出基于这些结构的实用算法案例与Python代码。
0.3B参数,600MB内存!腾讯混元实现产业级2Bit量化,端侧模型小如手机App
腾讯混元团队推出面向消费级硬件的“极小”模型HY-1.8B-2Bit,参数量仅0.3B,内存占用600MB。它基于产业级2Bit端侧量化方案,生成速度提升,还通过多种方法提升能力,未来将探索新技术缩小与全精度模型差距。
独家对话极映科技高鑫:我们为什么要做一个比Sora难10倍的物理世界模型?|甲子光年
本文是对极映科技创始人高鑫的独家专访。极映源于高鑫早年体验,团队具深厚经验。其模型回归底层定律,响应快。投资人看好,专家认为能解决痛点。高鑫谈技术、前景、商业化等,称有望引领物理仿真变革。
AI看图一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华
随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看图方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。
当AI遇到物理学 —— AAAI大会主题演讲(Daniel)
2026年AAAI大会上,物理学家Daniel Whiteson演讲探讨机器学习与基础物理。指出粒子物理用还原论解释宇宙,虽发现基础粒子,但仍有诸多未知。粒子对撞实验复杂,需机器学习辅助,深度学习已广泛应用,还能助力发现新粒子。
中国半导体的下半场开启了吗?
国产替代曾让中国半导体制造和设备成绩斐然,但在资本眼中已无新故事,AI成投资新宠。不过半导体新旧技术迭代不停,产业稳定增长,中国半导体核心仍是制造和设备,国产替代需持续投入。
昆仑万维多模态视频生成开源,影音图文全统一
昆仑万维开源的SkyReels-V3,通过统一多模态上下文学习框架,实现参考图像生成视频、视频持续扩展及音频驱动虚拟数字人功能,在视觉质量与指令跟随性上逼近闭源顶尖水平,为开源社区提供强大研究基座。
登顶行业SOTA的多模态视频生成标杆,昆仑天工刚给开源了
昆仑天工发布的多模态视频生成模型SkyReels-V3正式开源。它能文生视频、图生视频等,效果逼真。该模型针对现有AI视频问题实现多方面技术突破,且昆仑天工在模型和产品层面均有深厚积累。