训练数据生成」共找到 5507 篇相关文章

推荐文章7

Agent狂欢下的冷思考:为什么说Data&AI数据基础设施,才是AI时代Infra新范式

文章指出Agent成AI主流叙事,但企业部署后效果不佳,因未认识到Agent平台无法单独构成AI Infra。强调数据是AI Infra核心,提出Data&AI数据基础设施是新范式,还分析赛道玩家并介绍科杰科技的实践。

机器之心
产品应用8

英伟达祭出NVFP4核弹:大模型训练根本性转变,GB300效率狂飙7倍

英伟达推出新格式NVFP4,能以4 - Bit速度与效率实现16 - Bit生产件级训练精度,是LLM开发重大飞跃。虽处于研究阶段,但正与多组织合作。还介绍其方法、优势,实验也证明它在大规模训练的有效性。

AI寒武纪
算法论文8

英伟达笑到最后!训练2000步,1.5B逆袭7B巨兽,Scaling真来了

英伟达团队提出ProRL训练法,将强化学习扩展到超2000步。用此方法训练的15亿参数模型媲美70亿参数的Deepseek - R1 - 7B,在多任务中表现出色,解决了熵崩溃和训练不稳定问题。

新智元
算法论文7

JCP | 中科院力学所孙振旭研究员团队:关于物理信息神经网络的预处理:如何在流体力学中更好地利用数据

物理信息神经网络(PINNs)为求解微分方程正反问题提供灵活框架,但数据预处理领域待探索。本文提出数据预处理方法,通过对数据和方程归一化,在四个湍流案例中提升PINNs流场重建预测准确度,不增计算成本。

力学与人工智能
新闻资讯7

DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜

DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。

机器之心
新闻资讯7

独家|红杉领投,智元旗下具身数据平台业务觅蜂科技获数亿元融资

AI科技评论独家获悉,智元机器人旗下具身智能数据平台觅蜂科技完成数亿元种子轮与天使轮融资,由红杉中国领投,多家资本跟投。此次融资用于技术研发等,觅蜂已布局全类型数据,还将建立数据联盟。

AI科技评论
推荐文章7

告别模板时代!妙多VP张昊然:生成式AI如何驱动UI设计的范式革命

在AICon2025上海站,妙多副总裁张昊然分享生成式AI在UI设计领域的影响。他回顾初代生成式UI的‘套模板’技术,讲述技术革新后回归代码生成界面,还探讨让AI理解设计系统、妙多AI 2.0理念及未来UI工具假设。

InfoQ
开源动态8

美团重磅开源!13.6B通用视频生成大模型,能文生视频、图生视频、还能续写!

AI视频生成竞争激烈,美团团队在GitHub开源通用视频生成模型LongCat-Video,参数量13.6B,能文生视频、图生视频、视频续写,几分钟生成720p、30fps长视频,有核心优势,还介绍了安装部署等内容。

开源星探
算法论文8

短视频刷多了AI也会变蠢!“年度最令人不安的论文”

最新研究显示,大模型灌多垃圾内容会‘脑损伤’,研究人员用不同维度定义垃圾数据训练模型,测试其核心能力,发现垃圾数据致认知下降,且损伤不可逆,还给出行业启发。

量子位
新闻资讯8

振臂一挥,大半个具身机器人圈都来了!智源研究院:别藏了,谁贡献数据多,谁的大脑就更好用

2025智源具身智能Open Day上,智源研究院院长邀厂商共享数据,称谁家贡献多,具身大脑在其机器人上更好用。智源无商业包袱,开源数据、统一评测,布局具身大小脑体系,欲做具身智能“安卓”。

量子位