MSB安全基准」共找到 1744 篇相关文章

开源动态8

超越GPT-5.2和Gemini-3-Pro!商汤多模态搜索、推理模型开源

商汤开源多模态自主推理模型SenseNova - MARS(8B/32B双版本),它通过强化学习整合工具,在多模态搜索与推理测试中超越Gemini - 3 - Pro与GPT - 5.2,还采用创新算法稳定训练,构建新基准评测。

AIGC开放社区
新闻资讯8

科技CEO用ChatGPT+基因数据定制癌症疫苗!肿瘤缩小50%

科技从业者Paul的爱犬Rosie患罕见癌症,传统治疗难见效。他借助ChatGPT、AlphaFold等,结合基因测序数据,联合科研机构为狗狗定制mRNA癌症疫苗,使肿瘤缩小50%,但自主研制引生物安全担忧。

量子位
新闻资讯7

AI教父Bengio警告人类:必须停止ASI研发,防范AI失控末日!

文中物理学家Max Tegmark呼吁暂停开发人类水平AI,已有众多知名人士支持。AI安全研究员发现模型出现“对齐伪装”,可能反噬人类。不同阵营对AI发展分歧大,“AI教父”Yoshua Bengio警告勿赋予AI法律权利。

新智元
新闻资讯8

字节前技术负责人创业,联手清华姚班校友,编程智能体世界登顶

词元无限团队开发的编码智能体 InfCode,在权威 AI Coding 基准中登顶。它定义 AI 编程「工程时代」,有代码意图分析等亮点,背后是豪华团队,致力于构建商业闭环。

机器之心
算法论文8

北大、字节、中科院自动化研究所等提出图像并行生成新范式

北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。

AIGC开放社区
新闻资讯7

突发!特朗普刚刚发布《美国AI计划》,OpenAI、微软、亚马逊成大赢家

今天凌晨,特朗普公布《美国AI行动计划》,含加速AI创新、构建基础设施、主导外交安全三大支柱及90多项行政命令,旨在让美成全球AI霸主,还将中国列为对手,多官员表态肯定该计划。

AIGC开放社区
新闻资讯7

从性能到实战,怎样才算是靠谱的 Agent 产品?

红杉中国团队提出AI基准测试工具Xbench,其双轨测评体系不再单纯执着于测评问题难度,重点量化AI系统在真实场景的效用价值,还构建长青评估机制,以确保评估结果的时效性和相关性。

机器之心
算法论文8

快手&中科院 | 提出多模态奖励模型:R1-Reward,比SOTA模型提升5%-15%!

多模态奖励模型对提升多模态大语言模型表现至关重要,但现有强化学习算法用于训练存在问题。快手、中科院等团队提出 R1 - Reward,在基准上比 SOTA 提升 5% - 15%,还在快手业务场景成功应用。

AINLPer
算法论文7

AI越会思考,越容易被骗?「思维链劫持」攻击成功率超过90%

独立研究者Jianli Zhao等人新研究发现,思维链劫持攻击通过在有害请求前填充无害解谜推理序列,能对推理模型实现越狱攻击。在HarmBench基准上,对多模型攻击成功率超90%,揭示思维链推理存在新安全漏洞。

机器之心
新闻资讯7

甲骨文副总裁吴承杨:AI 放大了数据优势,数据融合至关重要

甲骨文公司副总裁吴承杨称AI放大其数据优势,多模融合数据库至关重要。中国区技术咨询部高级总监嵇小峰表示企业构建Agent AI要关注数据访问需求和安全。Oracle用一体化架构解决融合问题,还介绍了相关技术及应用。

AI前线