小目标检测」共找到 1688 篇相关文章

算法论文8

上交大 × 华为艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
推荐文章7

24条红书流量方法,AI使用者分层,各平台账号解封技巧等,【收藏】

这篇综合文包含6篇合集,涵盖红书流量增长心法、AI使用者分层、平台账号解封技巧、创业者项目放大方法、烘焙店盈利策略及执行力探讨等内容,对搞流量、创业及用AI有启发。

白杨SEO优化教程
算法论文7

Meta|提出RECAP,通过动态目标重加权回放,解决RLVR遗忘【文末送书!Agent相关】

近年来,可验证奖励强化学习(RLVR)提升了大模型在多任务上的性能,但带来“能力退化”问题。Meta等提出RECAP策略,结合“回放”与“动态目标重加权”,保持模型通用能力,提升推理性能,还提高推理效率。

AINLPer
新闻资讯8

Jeff Dean最新访谈:基础模型越来越强,团队如何与谷歌等巨头竞争?

Jeff Dean 在 Y Combinator 活动中与 Diana Hu 对谈,探讨 AI 创业者面临的问题。他指出推理成新瓶颈,预计有更多推理硬件;Agent 执行复杂任务进步快;团队可找 1%成功率问题;还提及稀缺能力及创业建议。

DeepTech深科技
算法论文8

ICCV 2025 | 红书AIGC团队提出图像和视频换脸新算法DynamicFace

红书AIGC团队提出图像和视频换脸新算法DynamicFace。该算法创新性融合扩散模型与3D人脸先验,解耦身份与运动信息,设计双流注入架构和时序一致性模块,实验证明其在身份保真与运动还原上优势明显。

机器之心
开源动态7

博大,仅1.7B媲美gemini2.5-pro,达到SOTA文档解析性能

dots.ocr是多语言开源文档解析器,把布局检测和内容识别统一在视觉语言模型中,虽LLM仅1.7B参数,却达SOTA性能。介绍了其预训练三阶段及SFT阶段关键策略。

PaperAgent
7

Meta新模型逼平Fable 5,扎:开源且便宜到你懒得算账

Meta推出新模型Muse Spark 1.3,在Artificial Analysis榜单中与Fable 5打平手。扎称其在Coding和Agent工作有大幅提升,还便宜。网友实测它真能肝、真能省,Meta团队核心研究员也透露背后改动。

量子位
新闻资讯7

31家最挣钱的AI公司盘点:平均20人、人均创收279万美元

近日,‘顶尖精益AI Native公司排行榜’引发关注,罗列31家团队、营收可观的初创公司。榜单上有不少AI套壳产品,如GPTZero等。AI工具提效让团队精简,精益团队有成本等优势,部分创业者倾向少融资。

Founder Park
新闻资讯7

陶哲轩:用了GPT-5 Pro后,尺度、宏观尺度很赞,中尺度有点垮

著名数学家陶哲轩用ChatGPT - 5 Pro研究曲率有界的球面问题,记录AI在不同层面的表现。尺度和宏观尺度AI有用,中尺度帮助有限。虽问题未解决,但他学到新知识,也意识到与AI协作要谨慎。

机器之心
新闻资讯7

DeepSeek新版R1直追OpenAI o3!实测来了:“版本升级”着实不

DeepSeek在端午节前更新R1新版本DeepSeek - R1 - 0528,看似版本更新实则提升巨大,在LiveCodeBench上几乎与OpenAI o3 - high相当,实测显示编程等能力显著优化,直追闭源模型。

量子位