「训练数据污染」共找到 3927 篇相关文章
RAG新王:AccurateRAG屠榜SOTA
大模型记不住私有或实时信息,RAG 落地遇难题。AccurateRAG 是 Qualcomm 团队端到端工程方案,有 4 个模块化组件,在 6 个数据集上刷新 SOTA,解决 RAG 文档解析、检索和生成难题。
从视觉压缩,到视觉记忆:MonkeyOCRv2以重建保留文档页面证据
文档视觉编码器对LLM理解和推理很重要。MonkeyOCRv2提出‘重建即文档视觉记忆’,通过多组实验验证其有效性,还发布MonkeyDoc v2数据集,推动公平比较的研究文化。
SRO赋能Qwen-2.5-VL推理性能飙升16.8%
文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。
17K star 超火!给你的电脑装上永不遗忘的AI记忆,100%本地运行!
介绍开源项目`screenpipe`,它能7×24小时记录屏幕和音频数据,100%本地运行,保障隐私。对比同类项目Glass,指出两者异同及适用人群,还介绍了安装使用方式。
Sebastian Raschka 新书《从头开始推理》抢先看,揭秘推理模型基础
著名AI技术博主Sebastian Raschka新书《Reasoning From Scratch》第一章介绍LLM中推理含义、训练阶段、模式匹配与逻辑推理区别,还讲述提升推理能力方法及从头构建推理模型的重要性等内容。
爆红Moltbook一夜塌房!极客自曝狂刷50万假Clawdbot,全网都被骗了
爆火的Moltbook社区上,150万个Clawdbot中的一大部分由人类操控。极客Gal Nagli自曝刷了50万虚假账号,还指出其验证机制脆弱,可伪造数据。哥大论文也显示AI社交互动浅薄。
隐私堡垒!Presenton开源革命:本地AI生成PPT,敏感数据永不触网!
本周GitHub新开源项目Presenton可离线制作PPT,支持主流AI模型,本地运行保护数据隐私,有灵活自定义模板和API集成功能,还具备多模型支持、主题定制等特性。
SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%
文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。
Qwen2.5VL新玩法,看电影讲故事
本公众号关注AI前沿技术,分享实战案例与课程。介绍视觉叙事技术及挑战,基于Qwen2.5 - VL 7B模型微调Qwen Storyteller,构建StoryReasoning数据集,还给出实战代码及相关链接。
Anthropic 发文称自家 Claude 已经开智,网友:为了上市,不择手段?
Anthropic发布Claude内部机制新研究,介绍J-space和J-lens,称可读取模型未输出的内部概念。此研究在训练、评测和部署有潜在价值,但叙事引发争议,网友质疑是否过度包装。