SDE评测体系」共找到 1165 篇相关文章

开源动态8

阿里达摩院开源具身大脑基模:3B激活参数性能超越72B,转身就忘事的机器人有救了

阿里达摩院开源RynnBrain具身大脑基础模型,全系列7个。它是业界首个有 时空记忆的模型,在20项具身Benchmark上超顶尖模型。具小而美优势,训练用自研架构提效,数据丰富,输入输出灵活。

量子位
算法论文8

2026 AI Memory最新综述:从理论到实战,一文读懂AI记忆的进化全景

2026年北邮百家MemoryOS团队联合华为发表《Survey on AI Memory》,涵盖AI记忆理论基础、4W分类体系、单/多智能体架构、评估方法与前沿趋势,梳理详尽全景图,还剖析未来挑战与方向。

AI科技评论
开源动态8

AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒!

当全行业争论30B能否挑战万亿参数时,清华大学等联合研发的AgentCPM - Explore智能体模型用仅4B参数,在深度探索类任务有出色表现,且开源全流程配套工具,打破小模型性能局限。

MCP Server
新闻资讯7

「AI 100」榜单启动招募,AI产品“年会”不能停丨量子位智库

2025年国内AI产品领域涌现诸多关键词,对应多款颠覆性产品。量子位智库2025年度「AI 100」榜单开启招募,分三大板块,采用定量与定性结合评估体系,还公开自研AI产品知识库。

量子位
算法论文8

深入感知级别图像理解:UniPercept 统一图像美学、质量与结构纹理感知

多模态大语言模型在语义级任务表现卓越,但在感知级图像理解有短板。上海人工智能实验室等机构联合发布 UniPercept,构建感知属性定义系统与基准测试集,训练强基准模型,在多方面表现超现有顶尖模型,应用潜力大。

机器之心
算法论文8

拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?

现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。

机器之心
产品应用7

告别“云端依赖症”:AI为何要“锁”进本地硬件里?|甲子光年

过去三年,AI产业沉浸在云端幻象,但走进现实面临诸多阻力,如物理距离、隐私、试错成本和监管等问题。下一阶段AI竞争转向算力位置争夺,英特尔酷睿Ultra系列处理器助力多行业实现本地算力部署。

甲子光年
新闻资讯7

IJCAI 2026每篇投稿收100美元,学术圈却评价颇高

当下AI学术会议投稿评审体系受大模型冲击,投稿和低质量评审激增。IJCAI 2026将采取新投稿模式,每篇投稿收100美元,主论文豁免,费用支持审稿人,学者对此多持积极态度。

机器之心
新闻资讯7

全国首部AI大模型私有化部署标准,公开征集起草单位和个人!

大模型浪潮下,企业对AI投入加大,私有化部署需求凸显,但缺乏成熟实施框架。全国首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》应运而生,已聚集30余家单位参编。

AI工程化
开源动态8

AutoDev CLI:打造 AI 生成的 AI Agent 质量保障与验证架构

文章介绍AutoDev CLI,它基于AutoDev MPP架构构建,旨在解决上一代AutoDev智能体测试难题。阐述其起步、迭代、演进、集成过程,实现从AI生成代码到验证、生成测试系统的转变,带来可验证、可演化、可移植的优势。

phodal