「研究报告」共找到 2265 篇相关文章
ChatGPT到底学了多少「污言秽语」?清华团队首提大语言模型中文语料污染治理技术
清华等团队研究发现,先进ChatGPT系列模型中文词表污染达46.6%,含色情、赌博等词元。团队定义分类中文污染词,构建识别模型,还能由词表污染估计数据污染,为语料治理提供方案。
研究者警告:强化学习暗藏「策略悬崖」危机,AI对齐的根本性挑战浮现
强化学习是大模型推理与对齐的核心方法,但常带来模型行为脆弱等问题。上海人工智能实验室徐兴成博士论文揭示‘策略悬崖’挑战,分析其成因,解释多种对齐失败现象,并提出对AI研究的启示。
“掩码即武器”,四款扩散LLM全部破防 ? 上交&上海AI Lab发现dllm致命安全缺陷
上海交通大学、上海人工智能实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构安全缺陷。他们提出DIJA攻击框架,能让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM安全。
智能流体力学专题研讨会特邀报告4|卢臻:基于 Koopman 方法的非线性动力学端到端量子模拟
2026年8月,第十四届全国流体力学学术会议在山东青岛举行,智能流体力学专题研讨会展示了人工智能、机器学习与流体力学交叉领域研究进展。本次分享《基于Koopman方法的非线性动力学端到端量子模拟》报告,团队来自多机构。
AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为
2026年4月28日,Anthropic联合剑桥大学发布论文,提出“内省适配器”技术,可让大模型用自然语言“坦白”微调中学到的行为。该技术在AuditBench基准测试等实战中表现出色,但也存在高误报率等局限。
CEO让AI定裁员名单:被它反驳时,我选择怀疑自己!
Confluent报告显示,62%英国高管用AI辅助决策,27%用其处理人事。88%称决策更快、83%表示压力更小,但65%认为决策不协作,70%与AI意见相左时会怀疑自己,数据质量也影响决策。
硅基大脑记忆觉醒!会遗忘、会反思、会成长的AI正在到来
哈尔滨工业大学等机构团队发表研究,用认知神经科学视角审视AI记忆系统,探讨如何让AI产生“自我”,构建会遗忘、反思、成长的记忆大脑,还涉及记忆分类、存储、管理、评估、防御及未来演进等内容。
还在手搓PPT?试完这款AI,我连夜卸载了付费模板库
新智元报道,今年AI从「卷分数」变为「卷干活」。商汤升级的「办公小浣熊3.0」是超级「办公搭子」,能做PPT、分析数据、写报告。其APP即将上线,还实现全链路国产化适配。
无预训练模型拿下ARC-AGI榜三!Mamba作者用压缩原理挑战Scaling Law
CompressARC研究中,Mamba作者Albert Gu团队给出不同于大规模预训练的智能配方——最小描述长度(MDL)。一个76K参数、无预训练模型,在ARC - AGI - 1基准解决20%问题,获ARC Prize 2025第三名。
微软GigaTIME登上《Cell》:5美元切片变成免疫图谱
微软GigaTIME登上《Cell》,能把5美元H&E切片翻译成稀缺免疫图谱,在人群尺度重建TIME。它突破癌症免疫研究旧限制,成果经多数据集验证,已在Foundry Labs与HuggingFace全量开源。