人工智能安全」共找到 1357 篇相关文章

开源动态8

首发 | 陈天桥盛大团队,推出最强开源记忆系统EverMemOS

EverMind团队发布面向人工智能智能体的长期记忆操作系统EverMemOS。它在主流评测集表现超此前工作成新SOTA,受人类大脑记忆机制启发设计,有四层架构和三大特点,已开源,后续将推云服务。

机器之心
新闻资讯8

分析1.8亿份招聘数据后,他告诉你AI究竟取代了哪些工作

本文分析1.8亿份全球招聘信息,发现AI不是造成大规模失业主因,影响因岗位而异。创意执行类岗位下降多,AI基建岗位增长,程序员、客服、销售较稳定,高层受冲击小,还给出评估岗位安全的建议。

花叔
开源动态8

达摩院推出多智能体框架ReasonMed,打造医学推理数据生成新范式

人工智能领域,推理语言模型在医学场景应用存在挑战,达摩院推出多智能体框架ReasonMed,提出医学推理数据生成新范式,开源百万级高质量数据集ReasonMed370K,验证了‘小模型 + 高质量数据’的潜力。

机器之心
开源动态8

上海AI Lab发布混合扩散语言模型SDAR:首个突破6600 tgs的开源扩散语言模型

上海人工智能实验室提出全新范式SDAR,通过‘训练 - 推理解耦’融合AR模型高性能与扩散模型并行推理优势。实验证明,SDAR性能与原版AR模型持平或超越,还能加速推理,且已全面开源全系列模型。

机器之心
算法论文7

VaseVQA:考古领域实现专家级,诊断+补弱RL框架

在文化遗产与人工智能交叉领域,研究人员提出把大型多模态模型放于‘诊断—补弱—精细化评估’闭环训练,配套结构化评测基准,让模型在文化遗产领域接近专家级能力。介绍了技术步骤、数据基准及关键发现等。

新智元
算法论文8

可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25

研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。

新智元
算法论文8

机器人「看片」自学新技能:NovaFlow从生成视频中提取动作流,实现零样本操控

布朗大学和机器人与人工智能研究所团队提出 NovaFlow 框架,利用视频生成模型常识知识,让机器人“看片”自学。它将任务理解与控制解耦,通过生成视频提取动作流,实现零样本操控,为通用机器人提供新路径。

机器之心
开源动态8

一周10来个模型被开源,阿里Qwen杀疯了~

阿里通义千问这周开源众多模型,如Qwen3 - Omni、Qwen - Image - Edit等,涉及全模态、图像编辑、安全审核等多领域。各模型能力出色,如Qwen3 - Omni能处理多模态输入,Qwen3 - VL表现超部分闭源模型。

PaperAgent
新闻资讯7

马斯克xAI自研推理芯片曝光!代号X1、台积电3纳米工艺、明年就量产

马斯克的xAI被曝自研推理芯片X1,用台积电3纳米工艺,2026年三季度量产。此前xAI就为自研芯片招兵买马,还将在西雅图设办事处。此外,特斯拉也在推进自研推理芯片。

量子位
开源动态8

告别“炼丹玄学”:上海AI实验室推出首个大模型数据竞技场OpenDataArena

上海人工智能实验室OpenDataLab团队推出开放数据竞技场OpenDataArena,致力于将数据质量评估从“玄学”变为“科学”。它有数据评测榜单和完整可复现的数据价值验证体系,为多类需求提供解决方案,还开源了核心工具。

量子位