「AI安全评测」共找到 10450 篇相关文章

新闻资讯7

OpenAI员工爆料:已抢先体验GPT-5!7月上线,疑似完全多模态

新智元报道,X上神秘爆料与网友灰度测试经历让GPT - 5讨论再升温。奥特曼称今年夏天可能推出,迈向完全多模态。此外,还提及OpenAI核心团队动态、出走高管新动作及AI发展风险与监管建议。

新智元
新闻资讯8

OpenAI挖到最新菲尔兹奖得主,字节刚出炉的科学家计划在瞄准谁?

今年菲尔兹奖得主之一Jacob Tsimerman将入职OpenAI安全部门。当下顶尖科学家流向头部大模型公司,AI与前沿科学融合成趋势。字节发布Seed STEM科学家计划。大模型下半场比拼基础研究,构建评测基准很重要。

机器之心
新闻资讯3

入侵30家大型机构、Claude自动完成90%?Anthropic 被质疑,Yann LeCun:他们利用可疑的研究来恐吓所有人

Anthropic称发现黑客用Claude AI自动化完成90%网络攻击工作,称对网络安全有重大启示。但外部研究人员谨慎质疑,Yann LeCun等认为是可疑研究和营销噱头,专业安全人员也不认可其历史性转折说法。

InfoQ
新闻资讯7

Anthropic官宣「封杀」OpenAI!GPT-5发布在即,竟被曝用Claude Code做开发?

本周二,Anthropic切断OpenAI对其大语言模型的Claude API访问权限,指其违约用Claude支援GPT - 5开发及安全测试。此举标志AI巨头围绕数据与接口展开新一轮封锁战,API成战略资源。

新智元
产品应用8

Figure 03重磅发布!指尖能感知回形针重量,年产1.2万台,这次要让人形机器人走进千家万户

Figure AI公司发布第三代人形机器人Figure 03,专为Helix、家庭和大规模应用设计。它有全新传感与手部系统,能感知回形针重量,还做了安全、易用设计,实现低成本量产,适用于家庭和商业场景。

AI寒武纪
开源动态7

遭黑客投毒、被网安圈群嘲蹭流量、英伟达建的沙箱半小时就被攻破!OpenClaw 之父揭开大模型圈最脏的潜规则

OpenClaw 之父 Peter Steinberger 在演讲中指出,该项目虽增长迅猛,却面临诸多安全问题,如大量漏洞警告、黑客攻击等。同时,他炮轰安全行业蹭流量,强调应正确看待风险。问答环节探讨了其未来、工作流等多方面问题。

AI科技大本营
产品应用8

黑客已死!Claude 两周挖出 Firefox 22 个漏洞

Anthropic与Mozilla合作,让Claude Opus 4.6对Firefox代码库做漏洞挖掘,两周发现22个漏洞,14个高危。Claude发现漏洞能力强,但利用漏洞能力弱。还研究用LLM做「补丁Agent」,为AI辅助安全研究建规范。

AGI Hunt
开源动态8

医疗领域DeepSeek时刻:蚂蚁 · 安诊儿医疗大模型正式开源,登顶权威榜单

2026 年初,OpenAI 报告显示不少人用 ChatGPT 咨询医疗问题,还发布了 ChatGPT 健康。近日,蚂蚁集团等开源的蚂蚁・安诊儿医疗大模型或成最优解,它参数量大,在多评测中登顶,技术优势明显。

机器之心
开源动态8

完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美元,复现DeepSeek的强化学习!

Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美元,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。

AI科技大本营
推荐文章7

LangChain官方实测:多智能体架构怎么选?

构建AI Agent时,单智能体应对复杂场景易“变笨”且难维护。LangChain官方评测主流多智能体架构,在复杂零售场景实验,对比单智能体、Swarm、Supervisor架构的性能、成本,还给出优化Supervisor架构的方法。

探索AGI