「One4D框架」共找到 3065 篇相关文章
中山大学&华为联合提出 Issue Resolution 数据集构建神器SWE-Factory:每条只要$0.024
中山大学和华为联合提出低成本开源方案 SWE-Factory,可自动收集代码打造高质量代码评估数据集。它能解决传统构建流程繁琐、依赖人工的问题,实现全流程自动化,还构建了 SweSetupBench 数据集,表现出色。
DeepSeek-R2!?神秘模型惊现竞技场,真实身份引网友猜测
大模型竞技场秘密上线神秘模型steve,对话中它称来自DeepSeek。网友热烈讨论其身份,有R2、V4等猜测。同时,因CEO不满及可能缺芯片,DeepSeek的R2再度延期。
打破长视频理解瓶颈:HoPE混合位置编码提升VLM长度泛化能力
如今视觉语言模型在长上下文任务表现不佳,CMU和小红书团队深入研究,首次提出多模态RoPE扩展策略理论评估框架,指出现有泛化能力不足原因,提出HoPE大幅提升VLM长度泛化能力。
单机H200最快DeepSeek V3和R1推理系统优化秘籍
作者从开源技术分享角度,盘点SGLang对单机规模推理的大量工程优化技巧,涉及FP8 Block GEMM演进、FusedMoE模块优化、Attention Backend优化等,助于提升DeepSeek V3/R1在单机H200上的推理性能。
千问3:开源第一不只是说说!
英伟达新开源的OpenCodeReasoning系列选千问作基础底座。千问3以Apache 2.0发布后,开发者生态更新频繁,衍生模型超10万,下载量破3亿,全球第一。其性能强,正加速开启全栈式AI时代。
具身智能发展趋势与展望 | 中国工程科学
文章深入探讨具身智能的概念、内涵、计算框架与系统实现,梳理发展现状、趋势与挑战,强调生成式AI在其演进中的关键作用,还分析我国发展进展、风险,并给出研究方向与对策。
ECCV 2026 | 一段视频,重建一个可仿真的动态世界
机器人走出实验室后,训练数据需覆盖真实世界情况。OVOW由多团队完成,被ECCV 2026接收。它从单目视频出发,输出可编辑、可碰撞的实例级Mesh,串联视觉基础模型完成流水线工作,能用于物理仿真。
爆火的 DeepSeek Harness,全网最全小白接入教程!
DeepSeek Harness 在 GitHub 上线不到三天 Star 数破 10 万。文章给出小白接入教程,介绍三种部署思路,包括手动安装、用 Agent 一键安装、一键安装桌面版,还给出其与多个框架的测评对比。
DSpark推理速度提升80%后,OpenAI宣布新方法将推理成本降低了一半
近日,OpenAI 工程师开发优化技术,将模型推理成本降一半。业内猜测或基于公开成果,也有人认为是模型量化。此前 DeepSeek 推出 DSpark,使 V4 模型推理速度提升 60%-85%,还引入峰谷定价机制。
视频版Nano Banana来了!内置Gemini世界知识;原版香蕉出图仅需4秒
谷歌开放Gemini Omni Flash API,将多模态推理与视频生成编辑结合,有4项关键能力,也有局限。Nano Banana 2 Lite出图快且便宜。二者串联使用,图像生成与视频创作可无缝衔接。