三阶段流水线」共找到 1569 篇相关文章

算法论文8

CVPR 25 |全面提升视觉感知鲁棒性,生成模型快速赋能维检测

香港中文大学(深圳)等单位学者提出 DriveGEN 无训练自动驾驶图像可控生成方法,无需额外训练生成模型,通过两阶段策略扩展训练数据,提升维检测模型鲁棒性,代码已开源。

机器之心
新闻资讯8

MMLab@HKU 闪耀 CVPR 2025!与全球顶尖学者共话 AI 前沿

CVPR 2025 于 6 月 11 日至 15 日在美国纳什维尔举行,MMLab@HKU 携 24 篇高质量论文亮相。其还是项国际竞赛的发起与主办方,主办六项前沿活动,研究成果展示了多领域进步。

AI科技评论
产品应用7

Token消耗暴降80%,Cloudflare让服务器原生支持Markdown:OpenClaw要笑醒了

Cloudflare发布Markdown for Agents功能,让Web服务器可向AI Agent投喂Markdown数据,抛弃臃肿HTML,Token消耗降80%,还引入内容信号机制,有手动挡工具,功能处Beta阶段,可免费启用。

AI寒武纪
开源动态8

华为开源突破性技术Flex:ai,AI算力效率直升30%,GPU、NPU一起用

11月21日,华为发布AI容器技术Flex:ai并联合高校将其开源。该技术基于Kubernetes构建,有大核心突破,能提升算力利用率,异构兼容性优于Run:ai,将推动国产算力应用。

机器之心
开源动态7

别再被昂贵 SEO 订阅费拿捏了:3.5k Star OpenSEO,直接做 Semrush/Ahrefs 开源替代

OpenSEO在GitHub约3.2k Star,想做开源版SEO工具箱,替代Semrush和Ahrefs。它把多项SEO工作流收进工具,通过MCP暴露给Agent,适合类人,并非万能,是更开放的工具底座。

小华同学ai
产品应用7

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%。它能完成输入视觉回答问题、做几何体等任务,重点解决多模态推理、视觉理解及与人类偏好对齐问题,介绍了模型结构、训练阶段等内容。

CourseAI
产品应用8

AI 模特时代到来:字节x清华推出商用级视频换装模型DreamVVT,保真度显著领先SOTA

字节跳动智能创作团队联合清华推出视频换装模型DreamVVT,基于Diffusion Transformer构建,用两阶段设计解决复杂场景痛点,支持多种输入,在保真度和时序稳定性上领先SOTA。

机器之心
开源动态8

清华开源|做一门课要3天?用 OpenMAIC,30分钟生成完整互动课堂|GitHub 15.6k

OpenMAIC 是清华开源的 AI 互动课堂平台,能将主题或学习材料快速转化为完整互动学习体验。它把课堂拆成多种交互组件,架构设计出色,支持多 LLM 服务商,还能在聊天应用生成课堂。

小华同学ai
开源动态8

字节开源多模态复杂文档解析模型!Dolphin:页面与元素并行解析,精准解析复杂文档!

多模态AI与文档解析兴起,传统OCR解析复杂文档常出错。字节跳动开源多模态模型Dolphin,通过两阶段机制精准解析,有多种功能,安装使用友好,适用于多场景,降低了复杂文档解析门槛。

开源星探
产品应用8

每2秒吃透一道高数大题!华为终于揭秘准万亿MoE昇腾训练系统全流程

华为揭秘准万亿MoE昇腾训练系统全流程,通过“昇腾+Pangu Ultra MoE”实现国产算力与模型自主可控训练闭环,从集群利用率、单节点算力、后训练技术方面突破,实现大模型高效训练。

量子位