安全评测」共找到 1493 篇相关文章

算法论文8

ACL 2026 | OPeRA Dataset: LLM真的能模仿人类行为了吗?首次系统评估LLM的人类行为模拟能力

美国东北大学等机构研究者提出OPeRA数据集,采集真实用户在线购物行为,支持系统评测LLM个体化行为预测能力。实验显示当前主流LLM在模拟人类行为上表现有限,揭示其能力边界。

机器之心
开源动态8

刚刚,OpenClaw登顶GitHub软件星标历史第一!已超越Linux

仅两月,本地AI框架OpenClaw击败Linux,登顶GitHub星标第一。它是开源本地运行的AI Agent框架,能接入通讯工具,虽引发安全危机和限制,却热度不减,反映开源社区趋势变化。

新智元
推荐文章8

现有AI都是假实时!Thinking Machines发布交互模型,离真正的贾维斯真的近了

Thinking Machines发布交互模型,切入与AI交互方式问题。该模型能原生支持实时交互,由交互和后台模型组成。架构设计独特,解锁多项功能,评测表现佳,但也存在长会话、计算部署等局限。

AI寒武纪
算法论文8

从「片段生成」到「长视频漫游」:OmniRoam探索轨迹可控的长视频生成新范式

在生成式视频发展中,长时序视频生成面临挑战。研究者提出 OmniRoam 新方法,通过全景表示和分阶段生成框架,提升视频时空一致性,还构建数据评测体系,实验表现优,有效率和 3D 应用潜力。

机器之心
新闻资讯8

库里被「采访」、杨紫被「演」短剧?别慌!蚂蚁AI鉴真拿下CVPR 2026冠军,专治黑产

深度伪造技术滥用,明星成换脸受害者,引发社会关注。蚂蚁集团AI安全实验室队伍MICV获CVPR 2026挑战赛冠军,还发布检测资源仓库。团队提出基于DINOv3的框架,解决AIGC检测难题,成果显著。

机器之心
新闻资讯7

Anthropic宣布练出神话级模型:Claude Mythos,代码和黑客能力吊打opus4.6,不向公众开放!

Anthropic宣布Project Glasswing计划,因训练出超强模型Claude Mythos Preview。该模型代码和推理能力超opus 4.6,扫描主流软件发现数千零日漏洞。此模型不向公众开放,计划先在Claude Opus验证安全机制。

AI寒武纪
新闻资讯7

解道奥赛题成本5000美元?陶哲轩警告,AI下一步要规模化的「更便宜」

谷歌新一代 Gemini 进阶版在 IMO 竞赛达金牌水平,华人数学家陶哲轩对此关注且担忧。他认为评估 AI 表现应谨慎,AI 发展需从定性转向定量,要‘降本增效’,未来标准化评测很重要。

机器之心
开源动态7

怀疑人生!!!程序员真被整不会了,27.2k Star FastMCP

文章介绍了27.2k Star的FastMCP,它是Python MCP应用框架,能让普通Python函数成为MCP工具。讲了其适合场景、省事原因及上线安全边界,还给出了适用人群和注意点。

小华同学ai
算法论文8

高潮从第几秒开始?GaMMA 让多模态大模型真正「听懂」音乐时间线

现有多模态大模型难以理解音乐时间线。复旦大学与字节跳动团队提出 GaMMA,采用双编码器融合网络,经三阶段训练,还推出 MusicBench 评测基准。实验显示,GaMMA 在多基准上表现优异,刷新 SOTA。

机器之心
新闻资讯7

硅谷最危险战争!Anthropic死扛封杀,营收狂飙190亿

美国政府给Anthropic贴上「供应链风险」标签,OpenAI同期签军方协议。Anthropic CEO Amodei指责OpenAI,备忘录外泄使与国防部解决方案告吹。虽被封杀,但有巨头支持,营收反超OpenAI,其安全红线获广泛支持。

新智元