大数据任务」共找到 7722 篇相关文章

产品应用8

英伟达帮你省钱,让模型推理「短而精」,速度快5倍

过去模型推理追求长链思维,导致推理链长、Token消耗、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减超70%且准确率不变,还适用于模型。

机器之心
7

对话Noitom Robotics CEO戴若犁:没有人比我更适合解决机器人的数据问题 | GAIR 2025

本文是对诺亦腾机器人CEO戴若犁的专访。他表示因机器人业务营收两年涨40倍,年初拆分成立机器人数据公司。该公司以数据为交割界面,有产品交付能力,已与六七十家头部公司合作。

AI科技评论
算法论文8

EMNLP2025 | 揭开LLM训练数据中的中文污染真相,有比“您好”高2.6倍的token?

近年来,型语言模型虽成功,但训练数据易混入不良内容。论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》探索此问题,定义PoC Token,开发PoCDetect和PoCTrace工具,揭示LLMs训练数据污染情况。

深度学习自然语言处理
新闻资讯7

别只盯着李飞飞!AI的「3D数据底座」已被这家中国公司悄悄建好

群核科技构建具身智能时代的「3D版ImageNet」,其SpatialVerse平台为机器人提供三维数据与仿真环境。借助新技术发布全球首个3D语义数据集InteriorGS,还与多机构合作,成果获学术和产业认可。

新智元
开源动态7

详解Github 35K+项目:打通200+数据源,构建企业级AI的数据统一入口,支持MCP【上篇】

文章实测开源的AI数据统一访问引擎MindsDB,介绍其架构、安装启动方法,展示跨多数据源统一查询、AI模型赋能数据查询等功能,还将在下篇介绍知识库与智能体特性。

AI大模型应用实践
算法论文7

姚顺雨署名:模型「现学现卖」能力首次被系统评估,腾讯、复旦联手发布CL-Bench

腾讯混元团队和复旦学研究人员联手推出全新基准测试CL - Bench,系统性评估模型上下文学习能力。测试显示十前沿模型表现不佳,揭示当前模型在该能力上的普遍短板,并指出未来四个探索方向。

AI寒武纪
算法论文8

突破LLM数据瓶颈:Meta等提出语言自我博弈,一台模型,两个角色,无限进化

Meta等团队提出“语言自我博弈”(LSP)框架,让语言模型自己和自己“玩游戏”,在无外部数据输入下自我改进。实验显示,其性能可媲美甚至超越用量人类数据训练的模型,为缓解数据稀缺提供新思路。

深度学习自然语言处理
推荐文章7

AI圈刚开始谈Loop Engineering,两位95后博士已经盯上了人类闭环数据

AI圈热词Loop Engineering强调AI工程应从单次prompt转向设计持续运行的闭环系统。具身智能争抢人类第一视角数据,脸谱心智由95后博士创立,发布Looped World Models,还提出Ego - NeuroLoop数据范式及相关采集和增强工具。

机器之心
推荐文章7

Agent狂欢下的冷思考:为什么说Data&AI数据基础设施,才是AI时代Infra新范式

文章指出Agent成AI主流叙事,但企业部署后效果不佳,因未认识到Agent平台无法单独构成AI Infra。强调数据是AI Infra核心,提出Data&AI数据基础设施是新范式,还分析赛道玩家并介绍科杰科技的实践。

机器之心
新闻资讯8

SIGGRAPH 2025奖项出炉:上科、厦入选最佳论文

本周三,全球图形学顶级会议 SIGGRAPH 公开今年论文奖项。该会议影响力高,涵盖动画、生成式人工智能等多领域。今年有上科、厦等校论文入选最佳,还有时间检验奖等,涉及动力学框架等研究。

机器之心