点云视觉」共找到 1842 篇相关文章

产品应用7

用户痛发现器

用户痛发现器是个Web应用,能从社交媒体自动发现用户核心痛,支持聚类分析和AI产品方案生成。它可输入关键词抓取抖音视频和评论,用GLM-4.6模型分析,还有优先级评分等系统。

GitHubStore
新闻资讯7

Agent规模化落地前夜,AI Infra的难题全都暴露了

随着AI Agent大规模落地,中国服务市场结构转变,AI基础设施角色改变。InfoQ联合腾讯发起「InfraTalk」直播,探讨AI Infra能力框架等。还解析其核心能力、难题、价值闭环标准及未来竞争焦

InfoQ
产品应用8

厉害了,智谱造了全球首个手机通用Agent!人人免费,APP甚至直接操控电脑

智谱发布全球首个手机通用Agent AutoGLM,免费且人人可用。它可在端执行任务,不占本地资源,还能操控电脑。能集成到多种载体,上线移动端API申请通道及开发者生态共建计划。

量子位
开源动态7

20人团队提前实现DeepSeek构想,AI算力变天?直击大模型算力成本痛

国内20人玉盘AI团队推出SRDA全新计算架构方案,试图从硬件源头解决当前AI算力核心瓶颈。该架构有诸多创新设计,能应对大模型训推痛,与DeepSeek构想契合,或成大模型专用架构分水岭。

新智元
算法论文8

细粒度视觉推理链引入数学领域,准确率暴涨32%,港中文MMLab打破多模态数学推理瓶颈

香港中文大学MMLab团队发布MINT - CoT视觉推理方案,解决多模态数学推理难题。它引入特殊Interleave Token,构建专属数据集,采用三阶段训练策略,实验效果全面超越现有方法。

量子位
产品应用8

腾讯混元A13B用130亿参数达到千亿级效果,Flash Attention作者

腾讯混元A13B模型仅130亿激活参数,却能和千亿级大模型竞争,获Flash Attention作者赞叹。它精准卡位性能与效率‘甜蜜’,依托高质量预训练和结构化后训练,多方面表现突出且已全面开源。

量子位
算法论文8

世界模型炒作了半年,反应速度还不如 VLA?穆尧团队和百度智能给出最新解法

生成式世界模型用于机器人控制备受争议,因其推理延迟高。上海交通大学 ScaleLab 团队等联合发布 AHA - WAM,解决推理延迟和时空分辨率错配问题,在任务成功率和推理速度上领先,还需系统协同推进落地。

InfoQ
算法论文8

StereoAdapter:北大首提自监督,适配水下双目深度估计

水下机器人深度感知难题待解,北大等机构提出StereoAdapter框架。它结合单双目视觉,以自监督学习适配视觉基础模型到水下域,设计双阶段结构、自监督训练策略等,实验效果好,未来还将多方面改进。

新智元
产品应用8

录屏扒代码、截图改网页!Kimi K2.5把「视觉x代码」玩明白了

Moonshot AI推出最强Agentic模型Kimi K2.5,发布后热度起飞。它实现多功能一体化整合,具备设计审美,支持可视化编辑,推出编程工具Kimi Code。在多项测试中表现优异,还能在办公领域发挥作用,其智能体集群提升了效率。

量子位
算法论文8

ICCV 2025|UV-CoT:无监督视觉推理新突破,偏好优化重塑图像级思维链

随着文本领域思维链推理机制成功应用,研究者将其引入视觉理解任务。现有模型有局限,本文提出UV - CoT新框架,设计无监督数据生成与偏好优化机制,提升模型能力,摆脱对人工标注依赖。

机器之心