小目标检测」共找到 1685 篇相关文章

新闻资讯8

DeepSeek-R2尚未问世,微软模型捡漏称王?6000样本炼出「数学作弊器」!

微软推出Phi-4推理模型系列,参数最多14B,能在本地高性能笔记本电脑上流畅运行。Phi-4-mini-reasoning在数学推理上性能超越DeepSeek-R1蒸馏模型,且参数规模更。文章还介绍了模型特点、训练方法、性能表现及局限性等。

新智元
开源动态8

刚刚,红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!

红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。

新智元
新闻资讯7

OpenClaw同时收到Meta和OpenAI收购邀约!扎闭关一周亲测,奥特曼祭出算力诱惑

OpenClaw之父Peter Steinberger称收到Meta扎和OpenAI奥特曼的收购邀约,扎亲自上手体验,奥特曼祭出算力诱惑。OpenClaw很火,GitHub star数不到一个月突破18.9万,但仍亏损,Peter希望其保持开源。

量子位
算法论文8

清华孙茂松团队 × 深言科技:以解释作为训练信号,让 8B 模型在幻觉检测上反超闭源大模型

大语言模型幻觉问题待解,成本与算力需求攀升。清华孙茂松团队联合深言科技提出FaithLens模型,把幻觉检测提升为整体评估,以解释作为训练信号,8B模型在多任务上超闭源大模型。

AI科技评论
产品应用8

阿里Qwen3.5模型发布:0.8B参数就能处理视频,边缘AI时代真的来了

阿里通义千问发布Qwen3.5系列四款模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。

AI工程化
开源动态7

红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?

红书联合多科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。

InfoQ
算法论文8

模型用不好Skill?新范式让模型学会Skill的底层逻辑,3B模型推理token省5倍,性能反超

浙江大学联合美团龙猫团队、清华大学推出SKILL0,提出技能内化思路。它在训练中引入关键机制,让模型把技能内化到参数里。实验显示,其效果出色,token效率高,为模型成领域专家提供新方向。

量子位
开源动态8

社区供稿丨以博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战模型能力新高度

近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。

Hugging Face
新闻资讯7

重磅!扎收购Manus,保持独立运营

Agent领域传来重磅消息,Meta以超10亿美元收购Manus,后者将保持独立运营,继续销售服务。其技术会整合进Meta产品,已服务全球数百万用户和企业,目标是服务Meta平台上更多用户。

AI寒武纪
新闻资讯7

突发!Jason wei也被扎挖走了

Jason wei是OpenAI研究科学家,是思维链、强化学习研究重要推动者,2023年2月加入OpenAI,此前在谷歌大脑工作。他和HYUNG Won Chung一同被扎挖走,二人是o系列模型及测试时间计算重要推动者。

AI寒武纪