智能体安全评估」共找到 4684 篇相关文章

算法论文8

ChatGPT到底学了多少「污言秽语」?清华团队首提大语言模型中文语料污染治理技术

清华等团队研究发现,先进ChatGPT系列模型中文词表污染达46.6%,含色情、赌博等词元。团队定义分类中文污染词,构建识别模型,还能由词表污染估计数据污染,为语料治理提供方案。

机器之心
新闻资讯7

1 亿美元 ARR、不设 AI 硬件产品经理,Plaud 如何拿下全球百万用户?

2023年6月Plaud AI推出AI录音卡片Plaud Note,一年多交付30万台、ARR达1亿美元,今年7月全球出货量达100万台。Plaud中国区CEO莫子皓称其更像大模型公司,无真正对手,分享了产品观和招人标准等。

AI前线
新闻资讯7

xAI联合创始人出走:连马斯克都留不住顶级人才

伊戈尔·巴布什金这位效力过DeepMind和OpenAI的AI老将,助马斯克建成孟菲斯超算集群后离开xAI,创办风投公司“Babuschkin Ventures”,瞄准AI安全赛道,揭示AI行业顶尖人才的追求。

AI工程化
算法论文8

研究者警告:强化学习暗藏「策略悬崖」危机,AI对齐的根本性挑战浮现

强化学习是大模型推理与对齐的核心方法,但常带来模型行为脆弱等问题。上海人工智能实验室徐兴成博士论文揭示‘策略悬崖’挑战,分析其成因,解释多种对齐失败现象,并提出对AI研究的启示。

机器之心
新闻资讯8

AI 编程冲击来袭,程序员怎么办?IDEA研究院张磊:底层系统能力才是护城河

在 AICon 大会上,IDEA 研究院张磊剖析多模态智能体发展难题,提出从“半结构化”场景切入的落地路径,分享工业界研究与产品平衡见解,还为年轻人在 AI 浪潮中发展给出建议。

AI前线
新闻资讯7

刚刚,Anthropic 又出新货:Claude Opus 4.1 发布,代码、推理能力再升级

Anthropic发布Claude Opus 4.1,是对Opus 4的小升级,提升智能体任务、代码处理和推理能力。付费Claude用户等已可用,价格不变。在编程评测表现佳,获多方好评,官方建议升级。

AI进修生
新闻资讯7

谷歌深夜放出 IMO 金牌模型,多项测试力压 Grok 4、OpenAI o3!网友评论两极分化

8月1日晚谷歌向Ultra订阅用户推Deep Think功能,Gemini 2.5 Deep Think模型在IMO夺冠。它是多智能体模型,能并行处理问题。多项测试中表现优于Grok 4、o3,不过网友评价不一。

AI前线
新闻资讯7

一个“蠢问题”改写模型规则!Anthropic联创亲曝:瞄准Claude 5开发爆款应用,最强模型的价值会让人忽略成本负担

Anthropic联合创始人Jared Kaplan在YC分享Scaling Law对大模型发展的影响及对Claude等模型的意义。他认为AI发展不平衡,建议构建未完全跑通的产品,还介绍了Claude 4优化,探讨人机协作等内容。

InfoQ
推荐文章7

技术狂飙下的 AI Assistant,离真正的 Jarvis 还有几层窗户纸?

随着AI技术进入新阶段,LLM面临新天花板,市场呼唤从「会聊天」迈向「能行动」的下一代AI Assistant。文章从智能规划与调用等维度分析其发展挑战,介绍不同技术路径并分析优劣势。

机器之心
产品应用8

国产AI首次「长出」原生记忆,非Transformer架构成新王!机器狗当场引爆WAIC

WAIC世界人工智能大会上,国产黑马RockAI的大模型Yan 2.0 Preview亮相,可多终端无损部署。它基于非Transformer架构,训练效率高,有原生记忆,实现端侧AI,展现出自主学习和多模态能力,引发关注。

新智元