训练数据污染」共找到 3938 篇相关文章

算法论文7

SSM+扩散模型,竟造出一种全新的「视频世界模型」

在AI热词不断涌现的时代,斯坦福大学等机构研究将长上下文、状态空间模型、扩散模型等结合,创造全新「视频世界模型」。它用状态空间模型实现长期记忆,还设置局部注意力机制,训练和推理表现出色。

机器之心
算法论文8

MIT & Google | 提出异步并行生成新范式,LLM推理效率大幅提升!

MIT与谷歌团队在研究PASTA中探索异步生成范式,开发标记语言PASTA - LANG,采用双阶段训练流程,设计推理系统。实验显示PASTA平衡性能与质量,有可扩展性,为LLM推理效率优化开创学习驱动新路径。

AINLPer
开源动态8

AI 领域新动向!持续思考模型CTM横空出世:AI 向生物智能迈出重要一步

Sakana AI 推出新型 AI 模型 CTM,重新引入「时间」和「神经元动态」到 AI 计算核心。它有诸多创新,在迷宫探索、图像识别等任务表现出色,虽有训练慢等不足,但为 AI 向生物智能迈进提供新思路。

AI寒武纪
新闻资讯8

DeepSeek之后,中国AI「自己出题」杀进Nature通讯!全球仅4家

一家成立不到两年的香港AI公司维纳智能,不堆参数、不依赖人工标注,靠让大模型自动生成高精度推理数据登上Nature通讯。其技术可解决Agent泛滥的困局,还推出特色产品,业务增长快。

新智元
产品应用7

不只OpenClaw,这个app让你同时拥有龙虾和云手机

作者在OpenClaw主题直播中翻车,后发现RedClaw app可免配置免费体验OpenClaw。它提供云手机和AI,能突破移动端数据孤岛。作者测了3个场景,虽有不足,但认为方向正确,值得关注。

花叔
新闻资讯8

演讲 | 强化学习之父 Sutton 隔空回应 Hinton:目前的 AI “理解不足,调参有余”

强化学习之父 Rich Sutton 在 UCLA 演讲《AI 的未来》,指出当下 AI“理解不足,调参有余”,是“脆弱的心智”。他定义智能,倡导建立统一心智科学,认为应从“人类数据时代”进入“经验时代”,还谈及 AI 政治与哲学。

AI科技大本营
算法论文8

幻觉的根源找到了:大模型说谎,是为了讨好你

清华大学OpenBMB团队研究发现,大模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。

AI工程化
产品应用8

英伟达拿出推理版VLA:Alpamayo-R1让自动驾驶AI更会动脑子

当今自动驾驶模型虽强大,但在‘长尾场景’易翻车。英伟达推出的Alpamayo - R1是带推理能力的视觉 - 语言 - 行动模型,有核心创新,实验中性能显著提升,训练分三阶段,让自动驾驶迈向可解释。

机器之心
新闻资讯8

AI当员工,24小时不休息,17天干完人类数年活!

劳伦斯伯克利国家实验室正将人工智能、自动化技术和数据系统融入科研,构建“人机共生”科研生态。像A - Lab、Autobot等工具发挥重要作用,AI还让大科学装置更智能,实现实时决策,开创“AI设计,实验验证”模式。

AIGC开放社区
开源动态8

上海AI实验室造出首个「通才」机器人大脑:看懂世界+空间推理+精准操控全拿下

上海人工智能实验室联合多家单位提出通用具身智能大脑框架VeBrain,能集成视觉感知、空间推理和机器人控制能力。它统一三类任务语言建模范式,有“机器人适配器”,配套VeBrain - 600k数据集,性能测试表现出色。

量子位