评估机制」共找到 1533 篇相关文章

新闻资讯7

太意外!教皇和Anthropic创始人,要联袂开发布会

5月26日,教宗利奥十四世将发布通谕《Magnifica Humanitas》聚焦「AI时代对人的保护」,Anthropic联合创始人Chris Olah受邀。梵蒂冈同步成立AI委员会。但有人质疑这是道德外包或公关道具,全球也缺乏有效约束AI发展的机制

新智元
算法论文8

攻克AI过度思考难题!美团新研究让通过“可验证”过程奖励激活LRM的高效推理

美团等机构研究团队针对LRM“过度思考”问题,提出可验证的过程奖励机制(VSRM)。它结合可验证奖励与步骤级奖励,为推理步骤分配奖励信号。实验显示其能降低输出长度并保持性能。

量子位
开源动态8

阿里通义的视觉RAG革命!VRAG-RL:基于强化学习的视觉感知RAG框架,性能飙升30%

阿里巴巴通义实验室推出VRAG - RL,融合视觉感知、多模态推理与强化学习,已在GitHub开源。它破解传统RAG处理视觉数据难题,通过创新机制提升性能,在多数据集表现出色,还将向更拟人化和低幻觉方向发展。

开源星探
开源动态8

7,700+ star 微软 SkillOpt 可以训练的Skill

微软研究院开源了SkillOpt(7700+ star),把Skill文档当成‘可训练的权重’来优化。它有独特的6阶段流水线、核心验证门控、Protected Regions机制,还有SkillOpt - Sleep预览功能,让Skill文档可系统化训练。

CourseAI
推荐文章7

2026跳槽暴富指南:这些公司的期权,可能比你的年薪值钱10倍

2026年为中国科技公司IPO大年,众多公司上市后员工获丰厚收益。文章列举小红书、月之暗面等公司,分析其期权价值与上市可能性,给出评估期权的框架及投资风险提醒。

AI Reading Hub
算法论文8

迎接范式革命:最新、最全的大模型Latent Space综述,NUS、复旦、清华等联合出品

大模型核心计算正从显式空间转向潜在空间,现有文献缺乏统一视角。NUS、复旦等机构的综述《The Latent Space》从五大视角构建框架,阐述潜在空间基础、演进、机制、能力,指出挑战与未来方向。

机器之心
推荐文章8

ReAct范式深度解析:从理论到LangGraph实践

文章深度解析ReAct范式,从理论出发,介绍其原理及解决的传统AI问题。分析LangGraph中ReAct实现机制,结合智能解决方案系统案例展示应用价值,还给出手写实践及使用ReAct范式的总结建议。

阿里云开发者
算法论文8

邱锡鹏老师团队发布VehicleWorld:让智能汽车真“智能”

邱锡鹏老师团队发布论文,构建高度仿真的智能座舱虚拟环境VehicleWorld,并提出基于状态的函数调用(SFC)方法。实验显示,SFC大幅提升任务执行准确率和效率,还构建了Vehicle Benchmark进行评估

深度学习自然语言处理
开源动态8

南洋理工、北大、上海AI实验室开源长记忆世界模型

目前世界模型模拟方法在维持长期一致性上有挑战,南洋理工大学、北京大学王选计算机技术研究所、上海人工智能实验室联合开源长记忆世界模型WORLDMEM,介绍了其记忆机制、基础架构、训练技术及检索策略等。

AIGC开放社区
开源动态8

76%程序员依赖AI?代码安全挑战解析

GitHub报告显示76%程序员用AI编程,代码安全成挑战。腾讯等团队建A.S.E评测框架,有项目级代码生成等优势,能评估代码安全、质量与稳定性,未来将扩充功能,邀开发者参与。

腾讯技术工程