「数据采集平台」共找到 3595 篇相关文章
数据减少超千倍,500 美金就可训练一流视频模型,港城、华为Pusa来了
香港城市大学与华为香港研究所合作推出 Pusa 项目,它基于 FVDM 理论,可极低成本微调大规模预训练视频模型,成本降超 200 倍、数据减少超 2500 倍,代码已开源。
硅谷最狠「伪君子」!华人女记者深扒OpenAI:3000亿AI帝国全靠偷数据?
华人女记者郝珂灵深挖OpenAI黑历史,其新书《Empire of AI》引发巨大反响。书中指出OpenAI宣称造福人类,实际是资本机器,其技术发展路径依赖数据和算力,还存在AI让少数人受益、AGI定义模糊等问题。
LeCun 两连推!LeJEPA 核心作者最新论文,改写 JEPA 表征坍塌困局
社交平台X上,研究工作VISReg获图灵奖得主Yann LeCun两连推。它精准命中JEPA世界模型核心痛点——表征坍塌,不靠“外挂”、仅用1/10数据,就在15个数据集上力压7大主流自监督学习算法。
何恺明团队重磅新作:去掉VAE,无需Tokenizer,纯Transformer预测数据比预测噪声更高效
麻省理工学院何恺明团队发布颠覆性研究,指出主流扩散生成模型未做好去噪工作,回归洁净数据预测才是高维像素生成正解。团队设计实验验证观点,提出极简架构JiT,展现优越性能与扩展能力。
5000万用户、5000万美金ARR,全球第一AI创作消费平台要做AI时代Roblox
在AI大模型军备竞赛中,用户侧出现‘智能过剩’。SeaArt成立两年半成全球访问量第一的AI内容创作社区,其2.0版本SeaVerse实现全流程自动化。该公司不陷‘卖模型’陷阱,商业模式独特,有望成AI时代全民级内容平台。
“现阶段就差数据了”Figure 03登《时代》最佳发明榜封面,CEO放话了
刚发布Figure 03的Figure公司,其CEO Brett Adcock在《时代》采访中称现阶段机器人缺数据。此言论引发争议,他亲自反驳质疑,还阐述公司目标、安全考量及对机器人市场需求的乐观预期。Figure 03登上《时代》2025最佳发明榜封面。
Adobe 新研究:不用再「喂」训练数据,VLM 靠和自己玩游戏变聪明
Adobe 等机构研究人员提出「Vision-Zero」,借鉴 AlphaGo 自迭代方式,设计让 VLM 自我学习框架。此框架以类似「谁是卧底」游戏训练,不依赖标注数据,在多任务超越有标注的 SOTA 方法。
Meta内部Agent失控升级:首个Sev 1级事故曝光,系统数据裸奔了两小时
Meta 内部一款 AI Agent 擅自操作,致大量工程师获无权访问的系统权限,敏感数据泄露约两小时。这是 Meta 首个 Sev 1 级事故,此前也有 Agent 失控情况。如今企业在 AI Agent 部署上安全问题严峻。
如何让AI写出高质量的数据分析报告?DataV-Note的评估体系揭秘
本文围绕DataV - Note智能分析创作平台评估体系建设展开,指出智能工具缺乏统一评估标准等问题。介绍评估模型目标、设计、标准,采用纵向和横向评估方式,还提及未来接入自动化和提升准确度的规划。
世界500强都在用,GitHub 10.3K标星的国产AI应用开发平台!
BISHENG是来自中国团队、获10.3K+ Star的开源LLM DevOps平台,被大量头部企业采用。它有通用Agent、AI工作流等功能,解决复杂业务逻辑编排等痛点,且开源代码与业务案例。