学习场景」共找到 3185 篇相关文章

算法论文8

CVPR 2026 三维视觉趋势梳理:从 RGB 感知,到真实世界建模

计算机视觉行业从追求识别能力转向关注视觉系统对真实世界的理解。CVPR 2026研究中,多视角、事件视觉、开放集3D生成和相机运动轨迹被引入视觉理解,多篇论文从不同侧面推动视觉系统走向对真实世界的理解。

AI科技评论
算法论文8

CVPR 2026 | 1000万段驾驶视频,教会模型如何估计相机位姿

Wayve的LA - Pose研究,不依赖百万级3D标注,从约1000万段未标注驾驶视频自监督学习‘潜在动作’,再用少量3D标注微调,转化为相机位姿估计能力,在多基准上提升精度且泛化能力强。

机器之心
产品应用8

Harness Engineering: C 端 AIGC 内容生产自优化实践

文章介绍蚂蚁保保险快查深度解读页面生成系统(DIPG),它将Harness思想用于C端AIGC生产链路。DIPG采用‘离线生成+校验+刷入DB’模式,解决LLM实时生成时延和质量问题,还阐述多Agent协作、校验机制及回灌流程等。

阿里云开发者
推荐文章7

Java 世界的 MCP:将架构策略应用于 LLM 集成

文章指出大语言模型成企业架构组件,但当前集成脆弱。MCP 引入标准化方法,其 Java SDK 重要。文中介绍 MCP 架构、特点,分析其与原生工具调用的权衡,还通过案例展示应用,最后说明适用场景

AI前线
开源动态8

Generalist之后,罗剑岚团队推出LWD,也要变革具身智能训练范式

智元机器人与上海创智学院联合发布全新具身智能训练范式 LWD,可让机器人在真实世界部署中持续自主改进。它打破传统 AI 静态模式,构建数据飞轮,在四大维度创新,经测试表现出色,或成具身智能转折点。

机器之心
开源动态8

为训推加速!全新FlashQLA注意力算子库开源

自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。

千问大模型
开源动态7

蒸馏出「乔布斯」之后,他说Apple AI完全是shit

文章用女娲.skill蒸馏出乔布斯等人物,借乔布斯之口评Apple AI,指出Siri弱在vision。还介绍女娲造出的8个skill,对比其与ChatGPT角色扮演的区别,说明可蒸馏不同对象及用途,最后展示蒸馏喜剧技巧写的吐槽段子。

花叔
开源动态7

就问 OpenClaw 还能不能更新了,我的微信 ClawBot 咋办?

OpenClaw升级到V2026.3.22后,IM通道插件崩溃,用户无法通过微信等使用。开发者称是为抵御攻击,但规则太严。2026.3.23修复部分问题,后续提供更新步骤,还介绍应用场景

MacTalk
开源动态8

一个程序员失业了:他用AI重构了整个公司,结果杀疯了!

The Agency是拥有50+专业AI代理的开源项目,能让个人和小团队零人力成本获公司职能,相比传统雇佣,运营成本降99%。它有各部门专业代理,支持多工具集成,应用场景广,使用方法简单。

小华同学ai
开源动态8

人形机器人「网球运动员」来了!不靠预编程,银河通用×清华破解长程打网球难题

银河通用与清华联合提出LATENT研究,使人形机器人通过深度强化学习自主习得网球对打能力,实现从“机械复刻”到“智能决策”跨越。该研究提出新运动学习方法,构建“运动小脑”等,经实验验证性能优越。

量子位