数据与评测基础设施」共找到 3249 篇相关文章

开源动态8

流式数据集:效率提升 100 倍!

现在只需一行代码,就能通过 `load_dataset('dataset', streaming=True)` 以流式方式加载数据集,无需下载。Hugging Face 优化后端,提升流式数据集速度与效率,减少请求、提升解析速度,还优化启动和流式加载阶段。

Hugging Face
开源动态7

数据与舆情双引擎:DeepAnalyze + BettaFish

DeepAnalyze是面向自主数据科学的大语言模型,能自动完成数据科学任务,支持完整流程、开放式研究且完全开源。还提出两项关键技术。微舆 - BettaFish是舆情分析系统,四类智能体协同工作,有六大核心优势。

带你学AI
新闻资讯7

Vercel 推出 Drains 功能:实现统一数据导出

Vercel 发布 Drains 系统,将平台可观测性数据统一导出至外部服务,覆盖多来源日志等。用户可两种方式配置,导出数据与多系统兼容,能简化接入流程、减少管道碎片化。

InfoQ
开源动态8

首个自主数据科学的智能体

DeepAnalyze是业界首个能自主完成数据科学任务的智能体大语言模型,可自动执行数据准备、分析等任务,支持多种数据源,且模型、代码等全部开源,还给出了使用和开发方法。

GitHubStore
新闻资讯7

RoboChallenge发布年度报告:评测标尺够权威吗?

当下具身智能行业存在缺乏真实场景验证、评测标准模糊等问题。2025年原力灵机与Hugging Face推出RoboChallenge评测平台,2026年1月更新榜单。AI科技评论从技术和核心设计角度对其进行深度拆解。

AI科技评论
产品应用8

基于阿里云 AgentLoop 的 DeepSeek Harness 评测实践

本文分享基于阿里云 AgentLoop 平台的 DeepSeek Harness 评测实践。介绍了 DeepSeek Harness 工程架构,阐述 AgentLoop 平台接入方式及价值,还详述评估器设计思路、展示评测结果,最后总结方法论并展望后续工作。

阿里云开发者
推荐文章7

搜索领域的下一个重大转变:从产品到基础设施

Lightspeed投资人称搜索正从人类产品转变为AI基础设施,像云计算支撑互联网,搜索将为AI提供信息。各公司集成搜索进展不同,还分析了搜索成基础设施带来的变化及新机会。

Founder Park
新闻资讯8

从 SQL 到 OSI:当“数据是什么意思”也有了标准答案

本文回顾 SQL 统一世界的历史,引出 OSI 标准。OSI 解决“数据是什么意思”的标准化问题,众多全球数据技术公司参与。还介绍各厂商语义层布局,分析对中国企业的影响及 OSI 未解决的问题。

InfoQ
开源动态8

我们对 Coding Agent 的评测,可能搞错了方向

用户对 Agent 不满常因它「做得不好」,不遵循指令和规范。当前主流评测体系以结果为导向,与真实场景错位。MiniMax 开源 OctoCodingBench 评测集,结果显示模型过程规范遵循不足,未来训练需引入过程监督。

Founder Park
新闻资讯8

2026具身智能数据赛道,卷出了一匹「黑马」

在具身智能面临数据掣肘的背景下,觅蜂科技宣布2026年4月16日将在上海举办一站式物理AI数据服务平台发布会,展示全栈方案,解决核心痛点,发布会有诸多看点,还将举办高规格圆桌论坛。

机器之心