「目标检测模型」共找到 8171 篇相关文章
地平线首曝BPU「黎曼」架构,用数学流形重构AI计算
2025 年 12 月 8 日深圳举办的地平线技术生态大会上,地平线首曝 BPU「黎曼」架构,用数学流形重构 AI 计算。还发布第四代编译器,推出 HSD Together 模式,开源具身智能模型,欲构建物理 AI 世界底层生态。
零一万物高管新阵容亮相,李开复加码布局ToB 2.0
零一万物ToB战略加速落地,公布新一轮高管任命,沈鹏飞、赵斌强、宁宁三位核心管理者亮相。其“一把手工程”依托万智平台,已覆盖多行业,在国内外均有合作成果,目标是让AI成企业转型推动者。
OpenAI闪电吞下Astral!Python开发者工具链沦陷,AI要住进你的终端
OpenAI宣布收购Python工具链明星公司Astral,团队并入Codex。Codex周活已破200万。AI编程入口之争从「谁的模型更强」升级为「谁能定义开发者的工作流」,OpenAI此举意在抢入口。
5Y News|「自然选择」完成3000万美元融资
AI陪伴公司「自然选择」完成超3000万美元融资,由多家机构联合投资。其推出的《EVE》呈现全新AI陪伴产品形态,从五维度重新定义“AI陪伴”,还发布情感大模型Echo - N1等。
Google这个1.5w star 项目牛皮,99%准确率!
Google安全团队开源AI文件类型检测工具Magika,抛弃固定规则匹配,用深度学习精准识别文件真实类型。它内置轻量模型,单CPU毫秒级推理,支持200+格式,准确率约99%,已大规模落地。
谢赛宁REPA得到大幅改进,只需不到4行代码
Adobe Research等团队对REPA展开研究,发现驱动目标表征生成性能的是空间结构而非全局性能。基于此构建iREPA,代码不到4行,能提升REPA收敛速度,在多方面表现出色。
这款开源工具 deface,支持一键人脸打码,告别逐帧处理!
如今拍视频常出现路人,手动逐帧打码工作量大。开源工具 deface 可自动检测视频/图片中所有人脸,实现一键匿名化处理,还能处理摄像头实时画面,简单易用。
时隔六年,OpenAI 为什么再次开源?
OpenAI发布两款开源纯文本推理模型,时隔六年再次开源。其gpt - oss - 120b性能与o4 mini相当,成本降超10倍。此次开源有战略考量,或是为构建生态、吸引企业,也反映出其对自身价值定位更清晰。
夜光影像里的"暗船":双分支 YOLO11 如何用抓非法捕捞
非法捕捞的暗船常关掉 AIS 隐身,难被传统手段监控。论文提出双分支 YOLO11,通过夜光遥感数据精准检测,还设计预处理流程,在测试集表现优,规模化应用也得到暗船率等成果。
语音分离最全综述来了!清华等团队深度分析200+文章,系统解析「鸡尾酒会问题」研究
清华等多校及字节跳动研究者全面调研语音分离领域,撰写综述论文,分析200余篇代表性论文。从问题定义、学习范式、模型架构等多维度展开,还探讨评估指标、数据集等,指出未来挑战与探索方向。