训练数据污染」共找到 3957 篇相关文章

开源动态8

里程碑时刻!首个100B扩散语言模型来了,技术报告揭秘背后细节

蚂蚁集团与高校联合团队推出 LLaDA2.0 系列扩散语言模型,其中 LLaDA2.0 - flash 参数量达 100B。技术报告披露细节,其解决了 dLLM 做大做强难题,性能比肩 AR 模型,为扩散模型工业化带来转机。

机器之心
新闻资讯7

斯坦福人均≈0.1张GPU!学术界算力遭「屠杀」,LeCun急了

学术界GPU荒严重,美国顶尖大学人均GPU少,与大厂差距大。如斯坦福人均0.14张,而微软等大厂数据中心算力惊人。这导致人才流向工业界,学术验证能力弱,但部分高校有改善措施。

新智元
算法论文8

视频模型也能推理,Sora2推理能力超过GPT-5

DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。

量子位
新闻资讯7

AI玩具和AI眼镜爆火,端侧市场或将超越云端?

当下AI难形成商业闭环,端侧AI或为落地答案。芯原股份戴伟民看好端侧AI市场,认为未来端侧推理需求或超云端训练,还指出AI眼镜、玩具、智能汽车等增量市场,同时介绍了芯原布局。

芯师爷
新闻资讯7

AI工具已成为史上最大流量入口?

作者白杨SEO看到一张称主流AI工具成史上最大流量入口的图,提出质疑。他指出数据存疑,AI用户使用量远不及搜索,商业化也不成熟,还对比国内外AI搜索优化GEO差异,认为企业要提前布局。

白杨SEO优化教程
算法论文8

下一代目标检测模型:3B参数MLLM Rex-Omni首度超越Grounding DINO,统一10+视觉任务

IDEA研究院团队用3B参数的Rex - Omni打破MLLM目标定位精度僵局。它统一视觉任务,结合坐标编码与强化学习,在多项检测基准超Grounding DINO等,解决定位和行为缺陷,为MLLM成下一代检测模型提供方案。

机器之心
开源动态7

超强开源OCR,手写体识别能力超dots.ocr,封存多年的老文档数字化有救了。

文章推荐新开源的OCR系统Chandra,它对手写体识别做了优化,官方测评数据显示比dots.ocr强。介绍其适用于多场景及功能特点,还展示了不同场景的识别效果,建议有需求者多对比测试。

开源AI项目落地
开源动态8

杨植麟带 Kimi 团队深夜回应:关于 K2 Thinking 爆火后的一切

上周,月之暗面发布并开源 Kimi K2 Thinking,主打“模型即 Agent”,一上线便引发关注。今日凌晨,杨植麟等人在 Reddit 开展 AMA 活动,回应 K2 Thinking 一系列问题,还回顾了其在多项测试中的亮眼成绩。

InfoQ
推荐文章8

95% 企业 AI 落地失败当下,另外 5% 的 CIO 在谈什么?

文章指出 95% 企业 AI 落地失败,痛点在于认知难对齐、技术业务错配、价值度量模糊、数据底座不佳。阿里云蒋林泉等 CIO 探讨解法,提出 RIDE 方法论,还分享太古可口可乐、顺丰等企业的 AI 落地经验与智慧。

InfoQ
算法论文8

让机器人在“想象”中学习世界的模型来了!PI联创课题组&清华陈建宇团队联合出品

斯坦福Chelsea Finn课题组与清华陈建宇团队联合提出可控生成世界模型Ctrl - World,可让机器人在“想象空间”预演任务。该模型使用零真机数据,提升下游任务指令跟随成功率。其相关论文已发布于arXiv平台。

量子位