大模型安全」共找到 9573 篇相关文章

推荐文章8

揭秘千卡 GPU 集群如何高效训练多模态模型:vivo AI 团队实战经验分享|AICon

在 InfoQ 举办的 AICon 会上,vivo AI 架构师王兆雄分享多模态模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。

AI前线
产品应用7

我让10个模型又参加了完整版数学高考,第一名居然是它。。。

作者让10个模型参加完整版数学高考,单独制定规则,邀朋友协助测试。结果令人意外,单选题第6题成噩梦,多模态题模型几乎全军覆没。讯飞星火和豆包145分并列第一,Qwen3屈居第三。

数字生命卡兹克
新闻资讯7

78%主创跳槽!Llama 14名作者只剩3人,Meta最强开源模型团队溃散引争议

据外媒消息,Meta面临严重人才流失,Llama模型14位核心作者中11位离职,或自立门户或跳槽。同时,Meta模型研发进度缓慢,旗舰模型屡次延期,一边裁员一边押注AI,且寻求资金支持遇冷。

AI科技大本营
新闻资讯8

图灵奖得主LeCun最后警告Meta!我搞了40年AI,模型是死路

图灵奖得主Yann LeCun预计将很快离开Meta。因Meta风向转变,LeCun失势。他投身AI研究40年,认为语言模型是死路,世界模型才是未来,或为此离开Meta并计划创业。

新智元
算法论文7

让推荐学会思考:用强化学习激活模型的序列推理能力

文章指出推荐系统曾未紧密结合模型能力,如今正靠近其训练范式。作者基于用户行为序列,用强化学习训练模型理解序列关系,以预测用户下一个可能点击的资讯,并通过实验验证了该方法的可行性,还探讨了不同数据库中BM25算法的差异。

AI科技评论
新闻资讯7

MMAR与AudioTrust技术解读,音频模型评测前沿进展分享 | AI Bench Talk直播预告

司南评测集社区 CompassHub 收录多维度评测集。此次 AI Bench Talk 直播聚焦音频模型,将分享评估其深度推理能力的 MMAR 及全方位可信评估框架 AudioTrust,还设圆桌讨论多模态/音频模型相关议题。

OpenMMLab
算法论文8

AI模型守法率提升11%,港科首次用法案构建安全benchmark

香港科技学KnowComp实验室从法律合规视角研究LLM安全,提出「安全合规」新范式。基于法律条文构建benchmark,用GRPO微调Qwen3 - 8B得推理模型,在新benchmark测试中性能提升显著。

新智元
算法论文8

陈丹琦新作:模型强化学习的第三条路,8B小模型超越GPT-4o

陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越模型,推理更像人类。

量子位
开源动态8

央企牵头!这个AI开源社区要让模型跑遍「中国芯」

6月30日百度文心模型4.5系列开源并登陆魔乐社区,该社区发起‘模型推理适配协作计划’,想让模型跑遍中国芯。其升级工具中心和协作空间,联动产业力量,解决模型在国产芯适配难题,推动生态发展。

机器之心
新闻资讯8

全国首部!AI 模型私有化部署标准起草单位 / 个人征集启动!

国内首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》立项,正征集起草单位和起草人。该标准全流程覆盖、多方面融合、三方协作,能解决企业部署痛点,构建安全可信生态。

AI大模型应用实践