「争议论文」共找到 1205 篇相关文章
为什么大模型会产生幻觉?OpenAI最新研究终于搞清楚了
OpenAI发布研究论文剖析LLM幻觉根源,指出当前主流训练与评估体系是核心驱动因素之一。现行评估奖励猜测行为,幻觉起源于预训练的‘下一词预测’,论文还澄清五大误区,建议改革评估体系。
AI女歌手攻占美榜!格莱美天后崩溃:人类嗓音不值钱了
近日,AI歌手Xania Monet登上Billboard电台榜单,签300万美元合约,引发争议。格莱美天后SZA等抵制,认为其贬低音乐;也有歌手觉得可接受。AI降低创作门槛,但也带来版权等问题,其艺术性存争议。
清华传奇姚顺宇立功!全新Gemini一夜血洗编程,全球仅7人能赢它
谷歌Gemini 3 Deep Think重磅升级,几乎刷爆全领域SOTA。编程界冲入Codeforces人类TOP 10,人类最后考试等测试也表现优异。还能解决科研工程难题,实测物理模拟能力强,给OpenAI带来压力。
Qwen2.5VL新玩法,看电影讲故事
本公众号关注AI前沿技术,分享实战案例与课程。介绍视觉叙事技术及挑战,基于Qwen2.5 - VL 7B模型微调Qwen Storyteller,构建StoryReasoning数据集,还给出实战代码及相关链接。
Vibe Coding,杀死开源!
Vibe Coding 带来编程效率狂欢,却切断开源生态维护者与用户联系。研究指出,AI 成「中间商」,使开源维护者得不到关注反馈,高质量开源项目或枯竭,作者设想代码版税机制但实施难。
苦研10年无果,千万经费打水漂!AI黑箱依然无解,谷歌撕破脸
ChatGPT「舔狗化」暴露AI缺乏可解释性,谷歌和Anthropic就「机制可解释性」产生争论。谷歌DeepMind不再将其作研究重点,Anthropic则主张重视。十多年研究成果有限,或应采取「自上而下」研究方式。
见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述
该文是对LLM奖励建模的「Analytic Rubric」范式的全面综述。介绍了Rubric概念来源,指出传统奖励模型存在对齐风险,而Rubric RM在多方面取得平衡,还阐述其工作流、各维度研究情况及面临的挑战。
17K star 超火!给你的电脑装上永不遗忘的AI记忆,100%本地运行!
介绍开源项目`screenpipe`,它能7×24小时记录屏幕和音频数据,100%本地运行,保障隐私。对比同类项目Glass,指出两者异同及适用人群,还介绍了安装使用方式。
世界模型最新综述!中科院联合MBZ、NTU、Oxford系统梳理前沿进展
中科院联合多机构及顶尖学者合作,系统梳理世界模型建模范式、方法等,归纳为四大分支,还梳理其在多领域应用、基准数据集等,讨论走向通用智能面临的障碍。
ACL 2025 Oral | 你的模型评测搭子上线:Evaluation Agent懂你更懂AI
上海人工智能实验室与新加坡南洋理工大学合作研发 Evaluation Agent,它能按需评估视觉生成模型,有可定制、高效率等优势。框架分提案和执行两阶段,评估结果佳,未来将拓展功能。