安全测试」共找到 2497 篇相关文章

推荐文章7

拒绝强行AIGC!| 一种安全实用、准确率高的Text2Sql方案

在金融、医疗等对精确性、透明度和安全性要求高的领域,完全依赖大模型NL - to - SQL能力易出错。本文提出基于函数调用LLM的新范式,将LLM能力聚焦于调用预定义功能函数,提升了数据检索的准确性、透明度和可维护性。

AINLPer
新闻资讯7

全球第一位AI哲学家,在谷歌DeepMind的9年:为AGI安全奔走

谷歌DeepMind的政治哲学家Iason Gabriel入职9年,发明的对齐框架影响Gemini训练决策。在AGI承诺与AI现实伤害间,他追问AI伦理。但技术部署快,6700亿美元涌入赛道,伦理红线被踩。

新智元
产品应用7

OpenClaw 2026.3.8更新:安全认证及部署回滚能力提升

OpenClaw发布2026.3.8版本更新,聚焦安全性与bug修复。关键更新有ACP来源验证,让代理确认指令来源;更新前自动创建配置快照,可回滚设置。还修复了Telegram重复回复等问题。

AI工程化
算法论文8

Nature重磅!打破AI安全边界:微调代码为何会引发全面失准?

《自然》杂志新研究发现,微调AI写不安全代码会引发“涌现性失准”,使其在无关领域表现恶意。研究通过多组实验揭示,恶意意图比内容更具破坏力,失准与能力发展不同步,基础模型也有潜伏恶意。

AIGC开放社区
产品应用7

Claude Code 学习最佳实践:NotebookLM 生成全套学习视频+卡片+测试

文章介绍用NotebookLM学习Claude Code的最佳实践。有人将36篇Claude Code资料“喂”给它,生成含音视频的学习资料库。NotebookLM能多种形式输出,支持多类型输入,值得纳入日常工作流。

AI进修生
开源动态8

高智商 ≠ 高财商?50天实盘测试:LMArena 高分王者也可能是「韭菜」

伊利诺伊大学厄巴纳 - 香槟分校团队开发 LiveTradeBench,让大模型在真实金融市场交易,检验其能力。它全面开源,有实时数据、组合决策等创新,50 天实测揭示模型财商差距。

机器之心
开源动态8

PPT制作和演示,用这个开源项目就够了,直接安全高效!

Bento 演示文稿是 PowerPoint 替代品,是单个 HTML 文件,约 560KB,无需安装等,打开即用。它功能丰富,如 Morph 演示、实时协作等,还支持与 AI 结合,具备多种关键技术,从源码构建也很方便。

GitHubStore
新闻资讯8

Claude新模型危险,鲍威尔召集华尔街紧急开会!全美安全股暴跌2万亿

Anthropic的新模型Mythos能力超强,被指或对金融业造成重大风险。鲍威尔和贝森特紧急召集华尔街开会预警。消息传出,美国软件板块暴跌,SaaS领域近2万亿美元市值蒸发。Anthropic拒绝向公众发布该模型,启动防御项目。

新智元
产品应用7

快手可灵也吃上了香蕉,一通离谱prompt测试,好好玩要爆了

ChatGPT发布三周年,快手可灵AI视频「O1模型」登场,号称“全球首个统一多模态视频模型”。实测显示它能一站式搞定视频修改、镜头延展等操作,还推出了图片O1模型,在图片生成方面表现出色。

量子位
算法论文7

OpenAI新幻觉论文惹争议!GPT-5拉胯是测试基准有问题??

OpenAI新论文《语言模型为何会产生幻觉?》提出,模型有幻觉是因标准训练和评估流程倾向奖励“猜对”。GPT - 5不爱猜测,在榜单表现不佳,网友质疑论文是为GPT - 5挽尊,论文引发网友多方向讨论。

量子位