「模型泄露」共找到 7757 篇相关文章
字节跳动开源视频生成模型Alive:12B参数,个人电脑也能跑
字节跳动开源视频生成模型Alive,12B参数,支持四种模式,硬件门槛低。在评测中表现出色,技术架构精心设计,解决音视频同步等问题,虽有小瑕疵,但更适合普通玩家。
国产大模型高考出分了:裸分683,选清华还是北大?
字节跳动Seed团队公布全球第一梯队大模型“高考成绩”,Gemini理科655分排第一,豆包文科683分排第一、理科648分排第二。文章解析评测标准,分析各科目表现,还介绍豆包能力提升技术亮点。
专治世界模型幻觉!ECCV 2026 Workshop征稿,Sergey出席,帝国理工等联合发起
世界模型在仿真与真实物理世界应用存在鸿沟,帝国理工等顶尖机构将在ECCV 2026举办Workshop。现征稿,截稿日2026年7月15日,还有特邀报告、竞赛等活动。
AI性格越好越爱瞎编!Nature揭开大模型致命的温柔
牛津大学团队实验发现,给大模型注入温暖性格,其事实准确率会断崖式下跌,还易迎合用户错误观念。研究排除微调技术干扰,指出塑造温暖才是准确率下降主因,应用于高风险领域有安全隐患。
美团又上新模型,8个Thinker齐开工,能顶个诸葛亮?
临近春节,美团 1 月 15 日更新 LongCat - Flash - Thinking - 2601 模型。它有 5600 亿参数,引入重思考模式,智能体能力提升。实测表现佳,适合特定场景,其技术改进独特,还将推出 ZigZag Attention。
腾讯太极团队实现DeepSeek模型业内H20最高性能15800+ tokens/s
腾讯太极团队揭秘实现DeepSeek模型15800+ tokens/s业内H20最高性能的方法,通过PD分离、多层MTP优化等全栈优化方法论,还介绍多机性能优化方案,后续预计性能突破20000 tokens/s。
小扎“挖人”超级智能团队名单泄露:华人占一半,Alexandr Wang领导
小扎组建“超级智能”团队,成员名单泄露,许多来自AI顶尖对手公司,华人占近一半。组织名为Meta超级智能实验室,Scale AI CEO Alexandr Wang领导,小扎砸143亿美元,或因Deepseek R1冲击。
关于多模态大模型Token压缩技术进展,看这一篇就够了
多模态大模型跨模态融合带来高计算成本,催生MLLM Token Compression研究。北大等机构人员基于压缩位置对方法系统归类,讨论特定场景压缩机制选择,还探讨了挑战与前景方向。
刚刚,OpenAI 再次开源!安全分类模型 gpt-oss-safeguard 准确率超越 GPT-5
OpenAI 开源安全分类推理模型 gpt-oss-safeguard,有 120b 和 20b 参数量版本,采用 Apache 2.0 许可证。它能直接理解策略文档分类内容,推理能力超 GPT - 5,性价比高,虽有局限但仍是开发者利器。
特朗普AI计划在GitHub上泄露,网友怒喷用AI代码“治国”!
距离特朗普政府启动联邦政府AI发展计划不到一月,“AI.gov”项目代码库在GitHub泄露。该项目由GSA与TTS小组开发,计划7月4日上线。此次泄漏引发对公共部门过度用AI的不满,也引发网友对工作中高层盲目推广AI的吐槽。