安全训练」共找到 2967 篇相关文章

新闻资讯8

Anthropic 研究发现:仅需少量污染文档即可对 LLM 实施投毒

Anthropic的Alignment Science团队研究大语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型越大攻击越易,还对微调数据集实验,引发讨论。

InfoQ
新闻资讯8

国家定调「人工智能+」:中国AI十年三步走,战略解读来了

2025年8月国务院印发《行动意见》,为AI发展绘就至2035年蓝图。提出“三步走”,还聚焦模型、数据、算力、开源等方面发展,强调监管安全,体现中国AI发展新方向与治理新思路。

机器之心
产品应用7

6K星 Qwen围绕Web AI,打造Agent Search新生态

自Manus带火深度研究代理后,新兴方向面临多模态代理推理能力不足等问题。千问2025年推出系列工具完成web智能搜索生态闭合,本文分享WebWatcher训练及解决问题的方法。

CourseAI
新闻资讯7

OpenAI秘密矩阵曝光!你的所有设备,被Codex连成一台超级电脑

OpenAI将Codex升级为「超级控制平面」,可控制所有安装该应用的桌面设备,将其连成Codex网络。它有远程控制、多机上下文共享等功能,还能在锁屏时工作,但存在安全隐患。

新智元
开源动态8

Sand.ai重磅更新MagiAttention,正在定义分布式Attention性能新标杆

2025年4月,Sand.ai开源MagiAttention v1.0.0。如今发布v1.1.0,适配Blackwell新架构,构建原生Group Collective原语,经系统级协同优化,在多模型训练中得到实证,展现卓越性能。

机器之心
新闻资讯7

大模型年中报告:Anthropic 市场份额超 OpenAI,开源模型企业采用率下降

本文基于年中报告指出,当前模型API支出翻倍,企业重心转向模型推理。Anthropic市场份额超OpenAI,开源模型企业采用率下降。代码生成成热门场景,企业换模型重性能,AI支出从训练转推理。

Founder Park
推荐文章7

大语言模型高考数学拿高分靠强化学习,那文科考高分得靠什么?

大语言模型在高考数学拿高分靠强化学习,但文科题无标准答案,此方法行不通。豆包1.6系列高考文科全科获683分,靠训练数据、思维链、长上下文和多模态直接读图等因素。

宝玉AI
开源动态8

开源首月斩获 1K+ star!大学生开发web终端工具,颜值高、功能强,真吊啊~

传统远程终端工具存在界面单一、功能有限等问题。大学生开发的开源Web应用Nexus Terminal,集成SSH等三大协议,有多重安全机制,适合中小团队运维等,开源首月获1K+ star。

开源先锋
产品应用7

FaceAge登上「柳叶刀」!AI一张照片看穿你的真实年龄

科学家开发AI工具「FaceAge」,登上《柳叶刀数字健康》。它能通过人脸照片预测癌症患者生物年龄辅助治疗。研究显示,脸显老的患者治疗效果差。不过,它存在训练数据局限,离临床应用还有距离。

新智元
开源动态8

无需任何 API 费用,这个Agent 拥有“看遍全网”的超能力

AI Agent 在网络信息获取上存在诸多难题,而 Agent Reach 能解决这些问题。它免费开源、安全且持续更新,兼容所有 Agent,支持多平台。安装简单,装好即可用,各渠道还能灵活替换。

GitHubStore