大模型数据」共找到 9982 篇相关文章

开源动态8

告别“炼丹玄学”:上海AI实验室推出首个大模型数据竞技场OpenDataArena

上海人工智能实验室OpenDataLab团队推出开放数据竞技场OpenDataArena,致力于将数据质量评估从“玄学”变为“科学”。它有数据评测榜单和完整可复现的数据价值验证体系,为多类需求提供解决方案,还开源了核心工具。

量子位
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

模型浪潮下,企业对AI投入加,私有化部署需求凸显,但缺乏成熟实施框架。全国首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》应运而生,已聚集30余家单位参编。

AI工程化
算法论文8

模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 幅提升LLM计算效率

Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“模型能力,小模型成本”。

AINLPer
新闻资讯7

五角楼计划将绝密数据喂给AI,训练军事特供版模型

《麻省理工学院技术评论》称,五角楼正讨论为生成式人工智能公司建安全环境,用机密数据训练军事特定版本模型。美国军方重构战略,推动先锋项目,还筹备用绝密数据训练模型,引发安全担忧。

AIGC开放社区
算法论文8

ICML 2025 Oral | 从「浅对齐」到「深思熟虑」,清华牵头搭起模型安全的下一级阶梯

语言模型加速进入高风险应用场景当下,“安全对齐”是挑战。如今广泛采用的“浅对齐”脆弱不堪。清华团队提出STAIR框架,能提升开源模型鲁棒性,还推出RealSafe - R1模型进行安全对齐。

机器之心
算法论文8

NIPS 2025 Spotlight | 港提出TreeSynth方法,一句话生成百万规模数据

团队提出TreeSynth方法,受决策树启发,将数据合成问题映射到其空间分割机制。它采用两阶段流程,能从零合成数据,还可优化现有数据集。实验显示其在多基准任务上性能提升显著,可扩展性佳。

机器之心
新闻资讯7

一夜之间,DeepSeek V4 Pro和Grok 4.6把全球模型推入了新的斩杀线。

DeepSeek V4 Pro和Grok 4.6在两小时内发布,逼近Claude Fable 5体验。作者分享常用AI组合,分析两模型优缺点,指出它们撕开模型不可能三角,形成新斩杀线,让夹在中间的模型难受。

数字生命卡兹克
产品应用8

AI真能搞钱了!这家公司把模型玩成闭环赚钱机器

当全行业还在卷模型参数、烧算力时,零犀科技走出不同路。其自研因果模型,用AI智能体帮企业提升销售。2025年已实现规模盈利,成为最早跑通商业闭环的模型应用公司。

量子位
开源动态8

首个自主数据科学的智能体

DeepAnalyze是业界首个能自主完成数据科学任务的智能体语言模型,可自动执行数据准备、分析等任务,支持多种数据源,且模型、代码等全部开源,还给出了使用和开发方法。

GitHubStore
开源动态8

单次训练横扫9个基准,遥感检测最数据集与基础模型框架问世

北京航空航天学团队发布面向通用遥感目标检测的规模数据集与基础模型框架 LEVIRDet,构建了 LEVIRDet - 159 数据集,提出 LEVIRDetNet 模型。前者为训练泛化能力强的模型提供新数据基础,后者在多基准测试中表现出色。

机器之心