评测集」共找到 1089 篇相关文章

开源动态8

AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒!

当全行业争论30B能否挑战万亿参数时,清华大学等联合研发的AgentCPM - Explore智能体模型用仅4B参数,在深度探索类任务有出色表现,且开源全流程配套工具,打破小模型性能局限。

MCP Server
开源动态7

让 AI 像真人一样操控手机完成各种复杂任务

MobiAgent是强大的移动端智能体系统,含智能体模型家族、加速框架、评测基准。能让AI像真人操控手机完成复杂任务,提供开箱即用App,内置经验检索模块可自动优化规划。

GitHubStore
算法论文8

腾讯发布大模型思考早停算法SpecExit,效果无损,端到端加速2.5倍!

腾讯为破解大模型长思维链效率难题,提出思考早停算法SpecExit,将思考早停与投机采样融合,在不影响准确性前提下,在vLLM上实现端到端加速2.5倍,还能缩短思维链长度。

腾讯技术工程
开源动态8

手把手带你入门机器人学习,HuggingFace联合牛津大学新教程开源SOTA资源库

HuggingFace与牛津大学研究者推出机器人学习教程,附带开源数据、模型等的LeRobot库。教程从经典机器人学讲起,介绍强化、模仿学习及通用策略,还提及解决现实瓶颈的技术与前沿模型。

机器之心
开源动态8

只有0.9B的PaddleOCR-VL,却是现在最强的OCR模型。

近期OCR赛道火热,作者应读者要求解读PaddleOCR-VL。它是百度PaddleOCR系列新模型,仅0.9B参数,在OmniDocBench v1.5评测多项领先。其架构高效,实测处理各类文档能力强,已开源。

数字生命卡兹克
算法论文8

ICLR神秘论文曝光!SAM3用「概念」看世界,重构视觉AI新范式

2023年Meta推出SAM,后SAM 2扩展到视频分割。近日,SAM 3现身ICLR 2026盲审论文,带来「基于概念的分割」新范式,强调按「语义概念」理解和分割图像,还构建数据引擎提升性能。

新智元
新闻资讯7

3年手搓ChatGPT!剑桥天才少年在Minecraft游戏中爆火回归

MC大神sammyuri时隔3年发布新作,在MC中复刻ChatGPT,名为CraftGPT。虽参数量小,但用Transformer架构,能和用户交互。模型训练用Python和小数据,视频存档公布助理解原理。

新智元
推荐文章8

ChatGPT架构师,刚发布了最新研究成果

Thingking Machines发布第三篇研究博客,核心作者是OpenAI联创John Schulman。研究关于LoRA参数高效微调方法,探究其匹配全量微调效率的条件,给出简化调参方案,还提炼出三个核心发现。

量子位
开源动态8

香港中科院发布聆音大模型,400万张图喂出个“AI超声神医”

中国科学院香港创新研究院发布超声大模型“聆音”,用超400万张图像的超声数据,经自监督学习训练。它在多项诊断任务破纪录,临床效果佳,还将模型等开源,有望推动领域发展。

AIGC开放社区
算法论文8

AgentFly:重塑Agent,无需微调LLM,如我们一样的记忆和经验持续学习

现有LLM智能体依赖静态流程或微调参数,缺乏灵活性且成本高。论文提出基于记忆的在线强化学习框架AgentFly,不更新LLM权重,在多基准测试表现出色,为构建通用智能体提供新范式。

深度学习自然语言处理