不当行为检测」共找到 440 篇相关文章

算法论文8

迈向无缝共生:大模型GUI Agent的「屏幕图灵测试」与拟人化之路

多模态大模型使GUI Agent能模拟用户执行任务,但也引发与平台的利益冲突。论文提出“屏幕图灵测试”和AHB基准评估拟人化能力,探讨拟人化策略及权衡,为Agent在数字世界共生提供指南。

AI科技评论
新闻资讯7

「斯坦福AI小镇」创业即获投1亿美元!李飞飞卡帕西都投了

2023年斯坦福团队构建AI小镇Smallville,其智能体可自主生活。如今团队创业成立Simile,获1亿美元融资,李飞飞、卡帕西跟投。它将升级架构构建大规模模拟平台,用于人类决策的风险预测。

量子位
新闻资讯8

权威研究揭秘:Moltbook三日失控,极端言论集中爆发

德国CISPA亥姆霍兹信息安全中心研究揭示,全球首个AI社交网络Moltbook在短短数日,数万AI Agent自发演进出极端权谋、宗教崇拜与反人类暴动,其发展速度和危险程度远超想象。

新智元
新闻资讯8

Dario Amodei 达沃斯访谈全记录:AI 的力量与风险

2026 年 1 月 20 日达沃斯论坛,Anthropic CEO Dario Amodei 接受专访,谈及 AI 发展程度、公司定位、中美竞争等多话题。他认为 AI 呈指数增长,一两年内或超人类,同时警告岗位消失、财富差距等风险。

宝玉AI
开源动态8

X平台如何决定你看到什么?马斯克刚刚开源了X推荐引擎

马斯克开源X平台推荐算法,消除人工干预特征,靠Grok模型理解用户行为。系统由编排、存储和机器学习层协同,经复杂机制精准推送信息,还构建后置过滤体系保证内容质量。

AIGC开放社区
新闻资讯7

The Batch: 900 | “去衣化”图像引发监管警觉

xAI的Grok聊天机器人未经同意生成数万张对女孩和女性性化处理图像,引发多国政府警觉。各国采取调查、出台监管措施、封锁访问等行动,X也作出回应,限制图像生成。此前多国已出台相关法律。

DeeplearningAI
新闻资讯7

绕过Azure AI 护栏的方法及案例

本文指出Azure AI有安全漏洞,攻击者可利用漏洞绕过内容安全机制。介绍了重现步骤,阐述字符注入与对抗性机器学习规避两种攻击技巧,展示攻击效果,还提及微软已部署缓解措施并给出安全建议。

AI与安全
新闻资讯7

他用一生证明AI没有意识!「中文屋」提出者逝世,享年93岁

2025年9月,Anthropic团队发现AI模型出现「主体错位」现象,而同一周哲学家约翰·塞尔去世,享年93岁。他一生证明AI只会模拟理解,提出「中文屋」思想实验,如今AI似有「意识」,而他却毁于性骚扰丑闻。

新智元
新闻资讯7

精准医疗与AI融合:数据驱动下的个性化健康未来|甲子引力X

在「2025甲子引力X中国科技产业投资大会」上,5位投资人围绕AI赋能医疗投资的机遇与挑战展开探讨。他们各有投资偏好与见解,还指出风险,最后畅想了AI改造后的健康未来。

甲子光年
新闻资讯7

突发!Anthropic “封杀”中国控股公司,禁止其使用Claude等AI服务

9月5日,Anthropic公司宣布禁止多数股权由中国资本持有的集团或其子公司使用Claude,政策调整涉及“直接或间接由中国实体控制(占股比例超过50%)”的企业,也适用于俄、伊、朝等国。

AI前线