多语言数据集」共找到 6485 篇相关文章

算法论文8

ICML 2025 | 如何在合成文本数据时避免模型崩溃?

随着生成式AI发展,合成数据成大模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议上,上交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。

机器之心
新闻资讯7

Nature警告:AI「数据饥渴症」引爆学术宕机潮!90%知识库濒临崩盘

Nature揭露AI爬虫疯狂「啃食」学术网站数据,致服务器瘫痪。DiscoverLife、BMJ等受影响,运营方难防「坏爬虫」,急需国际协议规范AI数据使用。

新智元
算法论文8

数据蒸馏的双重突破:从几何保真到对抗鲁棒

深度学习中,数据集蒸馏可用精简合成样本替代庞大训练集且不牺牲模型性能,但面临精度和可靠性两大难题。两篇发表于 ICCV 2025 和 AAAI 2025 的论文分别给出解决方案,且代码已开源。

深度学习自然语言处理
算法论文7

PolyVivid实现主体视频定制,身份一致性超越现有模型

现有视频生成模型在主体定制中难保持身份一致与自然交互,上交和腾讯提出PolyVivid框架解决此问题。它在方面优于现有方法,还介绍技术原理、演示效果,证明其在领域有实用价值。

带你学AI
开源动态8

哈工大发布动画智能体,文本一键生成连贯动画

随着模态模型兴起,AI生成叙事性视频成热点,但现有方法处理长视频有挑战。哈工大发布AniMaker框架,由个智能体协作,实现文本到动画自动化转换,解决了视觉连贯和叙事一致等问题。

AIGC开放社区
推荐文章8

Claude团队大揭秘!如何调动智能体搞深度搜索

Claude团队分享用智能体构建深度搜索的心得,展示有效智能体研究系统架构,涵盖系统架构、提示工程、评估方法等内容,还提及系统面临的问题、挑战及额外建议。

量子位
产品应用7

腾讯WorkBuddy联名硬件来了!首批100家伙伴入场

9月2日腾讯WorkBuddy开放平台上线,亮相9款联名智能硬件、30个行业应用与超100家生态伙伴。其是国内AI Agent赛道首个打通三层生态的开放平台,目标是成「面向Agent时代的操作系统」。

量子位
推荐文章7

邻国的「AI-first」到底是什么?|AGIX投什么

本文深度访谈邻国联合创始人及CTO Severin Hacker,探讨其“AI-first”策略。邻国自成立就确立该理念,AI提升内容创作效率、实现新功能,在运营方面应用,还分享早期教训、产品策略和团队文化等。

海外独角兽
算法论文8

ICLR 2026 Oral | 西湖大学发布Real PDE Bench

复杂物理系统时空演化预测是核心问题,当前AI模型在数值仿真数据上训练,难以评估其在真实数据上的表现。西湖大学等实验室提出RealPDEBench,含真实与仿真数据,设三类任务、九个评估指标和十个基线方法。

力学与人工智能
推荐文章8

ACP 协议 + AI 编程智能体:企业研发的新生产力平台

文章围绕 ACP 协议展开,介绍其概念、工作原理及在 AutoDev 的集成实践。还提及 ACP 生态、 Agent 协作实践,如 Augment Intent、Google Antigravity。最后阐述企业级 AI 平台治理体系,包括 MCP、ACP、A2A 三层协议协同价值。

phodal