安全 AGI」共找到 1350 篇相关文章

算法论文8

NeurIPS 2025 | ARGRE框架实现高效LLM解毒:自回归奖励引导,安全对齐更快、更准、更轻

北航等机构研究提出自回归奖励引导表征编辑(ARGRE)框架,在LLM潜在表征空间可视化毒性变化路径,实现测试阶段高效“解毒”。实验显示其降低毒性、缩短推理时间,不影响模型能力,优于基线方法。

机器之心
算法论文8

提升大模型内在透明度:无需外部模块实现高效监控与自发安全增强|上海AI Lab & 上交

大语言模型能力提升引发风险担忧,当前主流用外部“黑盒”监控模块解读模型表征,存在诸多局限。上海人工智能实验室和上海交通大学团队提出TELLME方法,摒弃外部模块,提升模型内部透明度,还提升了输出安全性。

量子位
推荐文章8

AI若解决一切,我们为何而活?对话《未来之地》《超级智能》作者 Bostrom | AGI 技术 50 人

本文是对《未来之地》《超级智能》作者 Nick Bostrom 的访谈。他探讨了人工智能发展到解决一切问题的“已解决世界”时人类面临的意义危机,如失去目标、工作冗余等,也提及应对伦理挑战、寻找新意义等观点。

AI科技大本营
新闻资讯7

Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了

近日,Anthropic发布研究,描绘AI正替代哪些工作。其构建“实际暴露度”指标,基于Claude对话数据测得。研究列出10大“高危”职业,也指出部分工作不受影响,还揭示高暴露群体特征及青年招聘情况。

AI前线
新闻资讯8

空间智能爆发只需24个月?群核科技首席科学家唐睿预言:具身智能才是AGI终极形态 | 万有引力

群核科技首席科学家唐睿在访谈中表示,空间智能是具身智能基础设施,可解决其数据不足痛点。破数据瓶颈靠普及感知硬件,2D、视频与3D生成走向融合,空间智能爆点24个月内或随硬件突破到来。

AI科技大本营
新闻资讯8

用人类脑电波教 AI 开车,这位清华 90 后学者直言隐式信号里藏着 AGI 的关键 | 万有引力

清华大学龚江涛团队用人类驾驶员脑电波教会自动驾驶模型“思考”,成果E³AD发表于NeurIPS 2025。龚江涛从计算机转向人机交互,在多段科研经历中积累经验,探索将人类“直觉”赋予AI。

AI科技大本营
新闻资讯8

港股AGI第一股“云知声”首战告捷:大模型贡献1亿收入,单客价直线提升116.2%,AI保险业务暴涨1386.8%

云知声发布《2025中期业绩报告》,亮点颇多。总收入4.05亿元,同比增20.2%,山海大模型收入近1亿,增幅457%。业务布局呼应国务院‘人工智能+’行动,技术优势明显,展现了AI产业化落地的成功模式。

量子位
产品应用7

小企业专属Claude来了!一键接入全套业务流,不用写代码AI自动算账催款

Anthropic推出Claude for Small Business,是全新连接器和工作流包,可嵌入小企业常用工具。操作简便,覆盖多领域,有安全保障,还配套培训课程和线下活动。

AI寒武纪
新闻资讯8

刚刚!AI 圈顶流 Karpathy 三连击:开源、泼冷水、AI 教育~

10月,AI圈顶流Andrej Karpathy有三连动作:开源nanochat项目,100美元可复刻ChatGPT;发表AGI十年论,给行业泼冷水;推进Eureka教育项目,重构AI教育范式。

PaperAgent
新闻资讯7

微软CEO和奥特曼失了和,OpenAI被“断粮”

《华尔街日报》爆料,OpenAI的奥特曼与微软纳德拉分歧加大,关系变微妙。在计算需求、通往AGI时间、内部竞争等方面有矛盾,微软暂停部分AI数据中心项目,双方合作关系面临挑战 。

量子位