安全研究」共找到 2667 篇相关文章

算法论文7

AI人格分裂实锤!30万道送命题,撕开OpenAI、谷歌「遮羞布」

Anthropic联合Thinking Machines研究,用30万个场景和压力测试拷问OpenAI、谷歌等前沿大模型。发现模型规范有矛盾漏洞,不同模型价值优先模式不同,如Claude重道德,Gemini重情感等。

新智元
8

我用MiniMax Agent开发了个带后端的全栈网站,全程0代码

2025年Agent成AI领域焦点,大厂纷纷布局。作者测试MiniMax Agent,发现其有四大特点:深度研究和上下文管理强,多模态输出出色,编程能力超预期,能执行定时任务,还能开发带后端的全栈网站。

花叔
新闻资讯8

库里被「采访」、杨紫被「演」短剧?别慌!蚂蚁AI鉴真拿下CVPR 2026冠军,专治黑产

深度伪造技术滥用,明星成换脸受害者,引发社会关注。蚂蚁集团AI安全实验室队伍MICV获CVPR 2026挑战赛冠军,还发布检测资源仓库。团队提出基于DINOv3的框架,解决AIGC检测难题,成果显著。

机器之心
新闻资讯7

Anthropic宣布练出神话级模型:Claude Mythos,代码和黑客能力吊打opus4.6,不向公众开放!

Anthropic宣布Project Glasswing计划,因训练出超强模型Claude Mythos Preview。该模型代码和推理能力超opus 4.6,扫描主流软件发现数千零日漏洞。此模型不向公众开放,计划先在Claude Opus验证安全机制。

AI寒武纪
新闻资讯7

Meta 大裁员,华人科学家田渊栋受波及

据 Axios 报道,Meta 本周二从超级智能团队裁撤约 600 岗位,涉及多部门,TBD 实验室不受影响。华人科学家田渊栋等受波及,此次裁员或因研究官僚化,团队重组是为 AGI 愿景铺路。

AI科技评论
新闻资讯8

GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道

OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。

量子位
新闻资讯7

一个提示攻破所有模型,OpenAI谷歌无一幸免!

HiddenLayer研究发现一种「策略傀儡」提示,将危险指令伪装成配置片段,配上角色扮演,能让ChatGPT等主流大模型开启「无限制模式」。此策略利用训练弱点,难修复且可扩展,厂商需智能监控。

新智元
开源动态7

怀疑人生!!!程序员真被整不会了,27.2k Star FastMCP

文章介绍了27.2k Star的FastMCP,它是Python MCP应用框架,能让普通Python函数成为MCP工具。讲了其适合场景、省事原因及上线安全边界,还给出了适用人群和注意点。

小华同学ai
新闻资讯7

硅谷最危险战争!Anthropic死扛封杀,营收狂飙190亿

美国政府给Anthropic贴上「供应链风险」标签,OpenAI同期签军方协议。Anthropic CEO Amodei指责OpenAI,备忘录外泄使与国防部解决方案告吹。虽被封杀,但有巨头支持,营收反超OpenAI,其安全红线获广泛支持。

新智元
新闻资讯7

AI甚至开始抢土木老哥的工作了

即便土木、建筑等传统行业,也受AI冲击。建筑业用AI克隆老师傅、替代部分人力,如Procore推出多款AI智能体,Skanska建立AI安全智能体。建筑AI生态矩阵正形成,国内需相关工具。

新智元