「预训练数据」共找到 3967 篇相关文章
爆红Moltbook一夜塌房!极客自曝狂刷50万假Clawdbot,全网都被骗了
爆火的Moltbook社区上,150万个Clawdbot中的一大部分由人类操控。极客Gal Nagli自曝刷了50万虚假账号,还指出其验证机制脆弱,可伪造数据。哥大论文也显示AI社交互动浅薄。
隐私堡垒!Presenton开源革命:本地AI生成PPT,敏感数据永不触网!
本周GitHub新开源项目Presenton可离线制作PPT,支持主流AI模型,本地运行保护数据隐私,有灵活自定义模板和API集成功能,还具备多模型支持、主题定制等特性。
SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%
文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。
Qwen2.5VL新玩法,看电影讲故事
本公众号关注AI前沿技术,分享实战案例与课程。介绍视觉叙事技术及挑战,基于Qwen2.5 - VL 7B模型微调Qwen Storyteller,构建StoryReasoning数据集,还给出实战代码及相关链接。
Anthropic 发文称自家 Claude 已经开智,网友:为了上市,不择手段?
Anthropic发布Claude内部机制新研究,介绍J-space和J-lens,称可读取模型未输出的内部概念。此研究在训练、评测和部署有潜在价值,但叙事引发争议,网友质疑是否过度包装。
人大系团队、天使轮数千万元融资,境瞳科技给人类社会建一个「世界模型」
境瞳科技获数千万元天使轮融资,要给人类社会建「世界模型」。其社会模拟器已有超 1350 万个 AI Agent,是全球同类系统中规模最大、置信度最高的。社会智能赛道在硅谷已吸引大量投资,国内境瞳科技是该领域唯一产学研团队。
单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025
基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。
Qwen2.5VL又多一个娱乐场景,看电影讲故事
文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。
龙虾爆出漏洞,斯坦福 OpenJarvis 重新定义本地 AI Agent,附实测
OpenClaw开源项目虽火但漏洞多,安全堪忧。斯坦福发布本地优先的个人AI Agent框架OpenJarvis,其架构模块化,数据本地处理更安全,安装简单,还能让Claude Code部署,值得关注。
刚刚,新一届ACM博士论文奖正式公布
近日,新一届 ACM 博士论文奖公布,含一个博士论文奖和两个荣誉提名。获奖论文探讨人机协作解决心理健康问题,荣誉提名论文分别聚焦计算模型局限性及大模型数据利用。