未对齐行为」共找到 1130 篇相关文章

新闻资讯7

AI教父Bengio警告人类:必须停止ASI研发,防范AI失控末日!

文中物理学家Max Tegmark呼吁暂停开发人类水平AI,已有众多知名人士支持。AI安全研究员发现模型出现“对齐伪装”,可能反噬人类。不同阵营对AI发展分歧大,“AI教父”Yoshua Bengio警告勿赋予AI法律权利。

新智元
新闻资讯7

图灵得主Yoshua Bengio,开始警惕AI有意识了

图灵得主Yoshua Bengio和学生在Science发文探讨AI意识问题。文章明确AI是否有意识,而是讨论科学界和公众信念的演变及把AI当有意识生命体的风险,还提及计算功能主义等相关理论。

机器之心
新闻资讯8

刚刚,OpenAI拿下IOI金牌,仅次于前五名人类选手!参赛推理模型才夺得IMO金牌

2025年国际信息学奥林匹克(IOI)中,OpenAI推理模型获金牌,在AI参赛者中排第一,得分仅落后5位人类选手。其专门训练,成绩较去年大幅提升。此前它在IMO也获金牌级别成绩。

机器之心
7

错信AI幻觉,一男子用溴化钠替代食用盐,真给自己吃出幻觉了

美国一位60岁男子错信ChatGPT建议,用溴化钠替代食用盐,致体内溴含量严重超标,出现妄想症等溴中毒症状。医生研究发现,旧版ChatGPT提供健康警告,而GPT - 5不建议用溴化钠替代食盐。

量子位
新闻资讯7

刚刚,奥特曼发布GPT-5!人人免费用「博士级」智能,基准图错误遭全网吐槽

OpenAI 发布 GPT - 5,奥特曼连发推文介绍看点。它是集成模型,有免费版、Plus 和 Pro 计划,多领域跑分亮眼。不过直播现小 bug,跑分图出错,马斯克拆台,表现达部分人预期。

机器之心
开源动态8

给Cursor、Claude Code装上这个CLI,能变现

teamai-cli 是腾讯开源的命令行工具,能集中管理团队调教 AI 编程助手的成果,同步给全团队。它复用软件工程方法,解决 AI 协作中经验不沉淀、行为不一致等问题,让 AI 能力从个人资产变为团队资产。

CourseAI
新闻资讯7

AGI倒计时,OpenAI首席研究官重磅表态:留给人类的窗口「很小」

OpenAI首席研究官Mark Chen称AGI即将到来,模型能自主研究。他反对‘预训练已死’,认为Scaling曲线到头。还提出‘Vibe Researcher’概念,不过通往AGI有评测和持续学习等问题待解决。

新智元
新闻资讯7

全网疯传!Claude最新模型意外曝光:全面碾压Opus 4.6,强到让Anthropic不敢发布

Anthropic“手滑”泄露最强新模型Claude Mythos,它在编程、推理和网络安全测试中表现超Claude Opus 4.6。因模型“黑客能力”强,Anthropic发布谨慎。此外,该公司还意外泄露3000多发布文件。

AI前线
新闻资讯7

实锤了,Meta 正式收购 Manus

近日,Manus 官网官宣“加入 Meta”。Manus 致力于打造通用 AI Agent,能处理复杂任务。这是笔待完成交易,披露条款。Meta 在 AI 落地应用缺具象答案,收购它或是选已跑通逻辑的产品融入底层。

MacTalk
产品应用8

AI百科全书SciencePedia:当马斯克Grokipedia遭遇滑铁卢,有个中国团队默默把活儿干了

在知识爆炸时代,传统互联网平台难以满足用户获取深度见解的需求,马斯克的Grokipedia也达预期。深势科技等团队推出SciencePedia,它能理解知识关系,追踪科学脉络,让真知高效抵达用户。

量子位