数据质量评估」共找到 3466 篇相关文章

新闻资讯8

国家定调「人工智能+」:中国AI十年三步走,战略解读来了

2025年8月国务院印发《行动意见》,为AI发展绘就至2035年蓝图。提出“三步走”,还聚焦模型、数据、算力、开源等方面发展,强调监管安全,体现中国AI发展新方向与治理新思路。

机器之心
新闻资讯7

Cloudflare 推出 Meerkat,实现全球强一致性协调

Cloudflare推出基于QuePaxa共识算法的Meerkat服务,可无领导者写入并保持强一致性,提升网络可用性。虽有往返通信代价且非通用数据系统,但优化对强一致性系统重要,还未投入生产。

InfoQ
新闻资讯7

92% 工程师都在用 AI 后,Uber 开始给 AI “限额”了

Uber的‘零增长技术栈’解耦容量与业务需求,优化Go运行时性能。还将生成式AI集成开发,92%工程师在用,但成本压力大。为此,Uber限额每位开发者,审查代码效果,完善评估指标。

InfoQ
产品应用7

80%代码由Claude合并,Anthropic内部人员点破Agent真相:「Close the Loop」

Anthropic团队研究产品经理Theo演讲指出,Claude已深入其工程流程,超80%代码由它合并。模型角色转变,能力提升,失败率下降。开发者应升级研发战术,如刷新评估基准、精简“脚手架”、闭环设计。

机器之心
产品应用8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5长文本推理专家,提供端到端长文本推理后训练“配方”,含数据合成管线、强化学习方法、智能体架构,在多基准测试成绩佳,代码已开源。

机器之心
推荐文章7

大语言模型高考数学拿高分靠强化学习,那文科考高分得靠什么?

大语言模型在高考数学拿高分靠强化学习,但文科题无标准答案,此方法行不通。豆包1.6系列高考文科全科获683分,靠训练数据、思维链、长上下文和多模态直接读图等因素。

宝玉AI
算法论文8

扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧

上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量

量子位
产品应用7

FaceAge登上「柳叶刀」!AI一张照片看穿你的真实年龄

科学家开发AI工具「FaceAge」,登上《柳叶刀数字健康》。它能通过人脸照片预测癌症患者生物年龄辅助治疗。研究显示,脸显老的患者治疗效果差。不过,它存在训练数据局限,离临床应用还有距离。

新智元
开源动态7

所有AI工具共享持久私有记忆,OpenMemory MCP杀疯了~

本文介绍实用的MCP Server - OpenMemory MCP,它能为AI提供持久记忆、跨平台和跨会话功能,数据私有,隐私有保障。还演示了本地化部署步骤,且官方封装成MCP降低了使用门槛。

探索AGI
推荐文章7

翁荔最新博客:我们可能高估了模型,却严重低估了那层“脚手架”

前OpenAI安全研究副总裁翁荔在新博客聚焦AI领域Harness Engineering。她认为Harness是决定模型在现实任务中走多稳、多远的‘脚手架’,并梳理其演进路线,也指出研究面临评估、安全等瓶颈。

DeepTech深科技