「低数据场景」共找到 4781 篇相关文章
斯坦福洗碗机器人新作!灵巧手跟人学采茶做早餐,CoRL 2025提名最佳论文
斯坦福等机构提出DexUMI框架,利用人手将操作技能迁移至灵巧手。该框架通过软硬件创新缩小人手与灵巧手具身差异,在两款灵巧手硬件平台验证,平均任务成功率达86%,数据采集效率提升3.2倍,被CoRL 2025提名最佳论文。
AI 设计9个月就能媲美Blackwell?OpenAI “辣芯”绕开英伟达正面战场,但老黄的GPU大盘不稳了
OpenAI 展示与博通联合打造的定制 AI 芯片 Jalapeño,性能媲美英伟达 Blackwell 或谷歌 TPU。计划年底部署,是多代芯片开发首步。它专为大模型推理设计,设计周期短,成本低,OpenAI 借此扩展全栈能力。
腾讯「鹅虾」紧急上线!一手实测:养虾门槛归零,QQ飞书钉钉全能接
腾讯昨日上线两个「鹅虾」产品,WorkBuddy是能接入多平台的智能体桌面平台,QClaw预计下周公测,可接入微信。作者实测WorkBuddy,考察其生态接入、代码开发等场景表现,还介绍了QClaw特点及腾讯云轻量应用服务器。
中科大 × 华为联合突破!SparseRM:1% 参数实现 LLM 偏好建模高效革新
中科大与华为联合提出SparseRM轻量级偏好建模方案,基于稀疏自编码器构建低参可解释奖励模型。实验显示它用不到1%可训练参数,在多任务中性能优,还能融入下游对齐流程,为LLM高效对齐提供新可能。
Claude Opus 5刚发布就被玩疯了~
Claude Opus 5刚发布,社区就玩疯了。Anthropic给它定位接近Fable 5,价格仅一半。网友让它与Fable 5、GPT 5.6等做物理场景测试,Opus 5表现不错,但也有不足。官方还给出了其Prompt指南。
告别高昂重制成本!港科大广州、快手可灵发布立体视频转换单步推理新方案
随着 3D 设备发展,人们对 3D 立体视频需求增加,但高昂制作成本成阻碍。快手可灵与港科大广州团队联合提出 StereoPilot 模型,能快速将 2D 视频转为高质量 3D 视频,还构建了 UniStereo 数据集。
VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确
纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。
刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次
Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。
具身智能还需要一个「五年耐心」
作者与具身智能领域人士交流后认为,具身智能还需「五年耐心」。当下通用机器人进工业产线挑战大,一到两年或迎「GPT - 3.0 时刻」,但到「GPT - 4.0」阶段还需解决数据、硬件等诸多问题。
一文读懂 RAG 与 KAG:原理、工程落地与开源实战(含代码与链接)
文章介绍RAG与KAG,RAG从文档找证据回答,适合开放域、时效更新快场景;KAG将结构化知识融进生成过程,实体关系与事实一致性更稳。还给出实战建议、工作流要点、最小可跑示例、开源组件及项目等。