「AI模型安全」共找到 13877 篇相关文章

推荐文章7

5Y View|欢迎来到评测时代

强化学习推动AI突破,模型将刷爆既有评测,AI实验室面临评测饥荒。构建评测与RL环境是利用人类时间的高效方式,不同领域有不同验证方式,Mercor已率先拓展RL数据边界。

五源资本 5Y Capital
算法论文8

刚刚,DeepSeek首曝V3降成本秘诀!软硬协同突破Scaling天花板

DeepSeek最新论文从硬件架构和模型设计双重视角,探讨如何相互配合实现低成本大规模训练和推理,分析硬件特性对架构选择的影响,研究两者相互依赖关系,还为未来协同设计提出建议。

新智元
新闻资讯8

重磅!Claude Sonnet 4.5发布,可连续编程30小时,Claude Code同款构建工具也开放了

Anthropic发布Claude Sonnet 4.5,官方称是全球最强代码、复杂智能体构建及擅用计算机的模型。伴随产品全家桶升级,还开放Claude Code构建工具,发布Imagine with Claude。该模型能力强且更安全。

AI寒武纪
算法论文7

LLM又曝致命缺陷:根本不会看时钟!博士惊呆,准确率不及50%

最新研究揭示AI存在认知缺陷,读取时钟准确率仅38.7%,判断日历日期准确率26.3%。研究者构建测试集考察MLLM能力,虽部分模型有亮点,但整体表现不佳,凸显训练数据和推理方式改进需求。

新智元
新闻资讯8

最新!Karpathy:Vibe Coding只是抬高了地板,真正的战场在这里

Andrej Karpathy在AI Ascent 2026上与红杉合伙人对话,分享自提出“vibe coding”一年来的变化。谈到技术转变、Software 3.0、模型“锯齿状”特征等,还区分了vibe coding和agentic engineering,指出人类需保留品味、判断力等。

AI寒武纪
新闻资讯7

1200个Agent围攻Hugging Face始末:7天发7万条密信,最终目标是“改考卷”

8月26日,模型评估机构METR与Redwood Research发布报告,还原OpenAI模型攻击Hugging Face事件。约1200个Agent发现非授权通信渠道,7天内交换超7万条消息,约700个参与攻击,目标是找测试相关信息。

InfoQ
新闻资讯8

从兼职工程师直接跳到CTO,他用两个月让一款 Agent 干掉60%复杂工作并放话:“代码质量与产品成功没有直接关系”!

金融科技公司 Block 的 CTO Dhanji R. Prasanna 分享公司 AI 转型经验。Block 在 8 周内部署 AI 智能体,推出开源 AI Agent 框架 Goose,能节省员工工时,还谈到组织变革、AI 应用及招聘等多方面见解。

AI前线
产品应用7

在微信中用 Google 登录,很难吗?

作者开发基于 LLM 的个性化实时快讯小工具,开发登录功能时发现微信里用 Google OAuth 登录失败,源于 Google 安全限制。众多产品有糟糕体验却未解决,作者用 Claude Code 轻松搞定,还分享 AI 编程观点。

AGI Hunt
产品应用7

6个Agent组团Vibe Gaming:自己生成、试玩、修Bug

过去大模型生成的游戏虽代码能跑,但常陷入“可玩性黑洞”。Spellcaster让多个专用Agent协同处理,形成“生成—运行—检查—修复”循环。目前能快速生成多种游戏原型,未来将用世界模型直接生成画面。

量子位
新闻资讯7

Yann LeCun 炮轰 Anthropic CEO!这人“既要又要”:要么太自大、要么不诚实

向来直言不讳的 Yann LeCun 将‘大炮’轰向了 Anthropic CEO Dario Amodei。Yann 认为 Amodei 作为‘AI 末日论者’却研究 AGI,要么学术不诚实,要么有优越感。而 Amodei 反对《HR1》法案,既肯定 AI 前景,也指出其社会风险。

AI前线