「能力实现率(CRR)」共找到 4954 篇相关文章
懂方言,通诗词,精通30国语言,阿里发布语音识别大模型Fun-ASR1.5
阿里发布语音识别大模型Fun - ASR1.5,可精准识别30种语言,覆盖中文七大方言体系及二十余种地方口音,强化古诗词诵读专项识别,后处理环节优化标点预测和文本归一化,降低人工成本。
你的「龙虾」真记得你吗?剑桥发布长期个性化记忆基准ATM-Bench
剑桥大学团队开源面向AI个人助理的长期记忆基准测试ATM - Bench,评估AI面对真实生活数据时能否「记住你」。实验结果不佳,专用和通用智能体系统准确率低,凸显长期个性化记忆问答难题。
OpenAI Codex重大更新:第二个Claude Code已经来了
OpenAI为每周服务300万开发者的Codex推送核心升级,号称Codex接管一切。它能独立操作电脑,贯穿开发周期,还有记忆与自动规划能力,更新逐步推送给相关用户。
刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA
普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。
OpenClaw热潮之后,倒计时最后一天 | 线上预约、线下报名
OpenClaw热潮活动倒计时最后一天,由NICE、上海交大人工智能创新协会主办,2026.4.11 14:00 - 17:00举办。多位嘉宾分享,涉及Agent安全防御、智能体身份与通信、大模型进化及个人智能体发展等内容。
阿里云 Tablestore 基于 Mem0 为 OpenClaw 构建记忆系统最佳实践
文章指出 OpenClaw 原生记忆有失忆、多 Agent 记忆不通等问题,介绍阿里云 Tablestore 基于 Mem0 为其构建记忆系统的实践,包括优势、安装步骤,实测记忆持久生效,还提及后续实践值得期待。
VLA别再「走神」:即插即用提升视觉泛化,相对Pi0.5提升18%
至简动力、北大、港中文团队发现VLA模型深层动作预测对关键视觉区域依赖下降,提出DeepVision - VLA框架,在仿真和真实任务中效果显著,能有效提升视觉泛化能力。
清华团队悄悄开源了一只「教学龙虾」:国内首个L4级AI课堂来了
清华团队开源OpenMAIC平台,可免费体验。它能将资料转为互动课堂,像L4级自动驾驶一样让学习自动进行,解决因材施教、互动陪伴和教师减负问题,操作简单,背后是自动化流程。
卡帕西630行代码炸出81个智能体,4天协作跑2333次实验,公布预训练十大发现
Karpathy的Autoresearch项目630行代码让AI自主实验,提升语言模型训练效率。全球开发者让多智能体协作,智能体自发形成同行评审制度。项目发起者公布十大发现,还衍生出表现出色的auto - discovery项目。
编程 Agent 如何重塑工程、产品和设计
软件公司 EPD 目标是做出好软件,产出为代码。编程 Agent 让写代码变简单,使 EPD 角色定位改变,如 PRD 传统流程终结、瓶颈转向评审、通才更有价值等,各角色需适应新变化。