技能评估」共找到 1021 篇相关文章

算法论文7

DeepMind让AI当「上帝」,导演一场只有AI演员的「西部世界」

Google DeepMind和多伦多大学研究人员受TTRPG和现代游戏引擎启发,提出Concordia软件库。它基于「实体 - 组件」架构,将工程师与设计师角色分开,能灵活构建多角色生成式AI系统,满足不同需求。

机器之心
算法论文7

见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述

该文是对LLM奖励建模的「Analytic Rubric」范式的全面综述。介绍了Rubric概念来源,指出传统奖励模型存在对齐风险,而Rubric RM在多方面取得平衡,还阐述其工作流、各维度研究情况及面临的挑战。

深度学习自然语言处理
推荐文章7

首席工程师之路:培养领导力

Sophie Weston 在 QCon 伦敦大会演讲称,成为首席工程师不仅要技术能力,还需影响力等。工作外如体育运动等能提升领导潜力,还建议融入科技社区、公开演讲,这些效果会成倍增长。

InfoQ
开源动态8

AI 行业悄悄统一了一件事:Agent Skills 开放标准全解析

Agent Skills 是一套开放标准格式,超 30 家主流 AI 开发工具已采纳。它结构简洁,有精妙的三层加载机制,解决了 AI Agent 上下文窗口问题。与 MCP 解决不同层面问题,生态正快速成型。

AI Reading Hub
产品应用8

吴恩达来信:DeepLearning.AI Skill Builder工具隆重上线!

DeepLearning.AI发布Skill Builder工具,可根据用户AI项目经历给出个性化反馈和提升建议,从初学者到高级用户都适用,完全免费,还会生成总结报告,Pro会员有更详尽反馈。

DeeplearningAI
新闻资讯7

Gartner:生成式AI不会取代软件工程师

全球著名咨询调查机构Gartner官网发布专访,分析师Haritha Khandabattu认为生成式AI不会取代软件工程师,其可提高生产力。还谈及在招聘人才方面的变化及领导者助团队成功的关键措施。

AIGC开放社区
算法论文8

从答题到做实验:SciAgentGym让大模型进入科学工作流

复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。

机器之心
算法论文8

让思考更准更长!强化学习新算法FIPO来了

阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。

千问大模型
开源动态8

Google开源Workspace CLI,让AI在终端操作办公全家桶

Google开源Workspace CLI项目,把全套办公工具装进命令行。它动态构建命令结构,输出为结构化JSON。内置超100个Agent Skills,支持多MCP客户端,认证灵活,还集成Gemini CLI扩展。

AI工程化
新闻资讯7

Google说,2026年AI Agent会有这五大趋势!

Google Cloud发布2026年Agent趋势报告,认为能改变业务的转折点是Agentic AI,总结了五大趋势,如人人都有Agent、流程自动化等,核心是让员工成Agent管理者和协调者。

探索AGI