数据驱动代理模型」共找到 3119 篇相关文章

产品应用7

如何构建企业级数据智能体:Data Agent 开发实践

本文介绍DMS的数据分析智能体Data Agent,它从实验室走向企业生产一线,革新数据分析范式。文中剖析构建要点,对比与传统BI、高级分析差异,阐述技术内核优化及企业级能力,为开发实践提供参考。

阿里云开发者
开源动态7

我MiniMax,用实习生处理数据,照样屠榜开源大模型

MiniMax M2屠榜开源大模型,引发社区热议。它在注意力机制、数据处理、思考模式上另辟蹊径,公开技术细节。M2团队选Full Attention,雇实习生处理数据,提出交错式思维链策略,强调实用性和泛化能力。

量子位
开源动态8

「百万级」视频推理数据集!30+顶尖高校联合发布

AI视频生成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。

新智元
算法论文8

庞若鸣还有苹果论文?改善预训练高质量数据枯竭困境

苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的高价值研究仍不断发表。研究团队针对大模型训练中高质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。

机器之心
新闻资讯7

谷歌发布 Firebase Studio 重大更新,用于代理式 AI 开发

7月初谷歌伦敦云峰会上,Firebase Studio展示重要新功能,包括自主代理模式、对MCP原生支持及Gemini CLI集成,旨在简化代理式AI开发,让其更自主、信息丰富且融入开发流程。

InfoQ
开源动态7

谷歌 Java 代理开发工具包新增 LangChain4j 集成

谷歌 Java 代理开发工具包(ADK)0.2.0 版本集成了 LangChain4j,显著扩展功能,让开发者能使用更多模型。谷歌开发者 Guillaume Laforge 解释其优势,ADK 还引入系列增强提升性能。

InfoQ
算法论文8

ICML 2025 | 如何在合成文本数据时避免模型崩溃?

随着生成式AI发展,合成数据成大模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议上,上交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。

机器之心
新闻资讯7

Nature警告:AI「数据饥渴症」引爆学术宕机潮!90%知识库濒临崩盘

Nature揭露AI爬虫疯狂「啃食」学术网站数据,致服务器瘫痪。DiscoverLife、BMJ等受影响,运营方难防「坏爬虫」,急需国际协议规范AI数据使用。

新智元
算法论文8

数据蒸馏的双重突破:从几何保真到对抗鲁棒

深度学习中,数据集蒸馏可用精简合成样本替代庞大训练集且不牺牲模型性能,但面临精度和可靠性两大难题。两篇发表于 ICCV 2025 和 AAAI 2025 的论文分别给出解决方案,且代码已开源。

深度学习自然语言处理
算法论文8

Meta提出数据筛选的理论:何时“少即是多”成立?

Meta针对机器学习领域‘少即是多’悖论提出理论框架,用高维统计等方法推导测试误差缩放定律,揭示数据筛选‘相变’条件,为实践提供指导,还重新定义‘数据效率’意义。

深度学习自然语言处理