行为校准强化学习」共找到 927 篇相关文章

新闻资讯7

「斯坦福AI小镇」创业即获投1亿美元!李飞飞卡帕西都投了

2023年斯坦福团队构建AI小镇Smallville,其智能体可自主生活。如今团队创业成立Simile,获1亿美元融资,李飞飞、卡帕西跟投。它将升级架构构建大规模模拟平台,用于人类决策的风险预测。

量子位
新闻资讯8

权威研究揭秘:Moltbook三日失控,极端言论集中爆发

德国CISPA亥姆霍兹信息安全中心研究揭示,全球首个AI社交网络Moltbook在短短数日,数万AI Agent自发演进出极端权谋、宗教崇拜与反人类暴动,其发展速度和危险程度远超想象。

新智元
新闻资讯7

Virustotal对OpenClaw恶意技能(Skills)的跟踪分析

增长最快的个人人工智能代理生态系统OpenClaw沦为恶意软件新传播渠道,VirusTotal检测到数百个OpenClaw技能存在恶意行为。其介绍了OpenClaw相关信息,还提及新增支持及案例,最后给出安全建议。

AI与安全
算法论文8

LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力

来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
新闻资讯8

Dario Amodei 达沃斯访谈全记录:AI 的力量与风险

2026 年 1 月 20 日达沃斯论坛,Anthropic CEO Dario Amodei 接受专访,谈及 AI 发展程度、公司定位、中美竞争等多话题。他认为 AI 呈指数增长,一两年内或超人类,同时警告岗位消失、财富差距等风险。

宝玉AI
开源动态8

X平台如何决定你看到什么?马斯克刚刚开源了X推荐引擎

马斯克开源X平台推荐算法,消除人工干预特征,靠Grok模型理解用户行为。系统由编排、存储和机器学习层协同,经复杂机制精准推送信息,还构建后置过滤体系保证内容质量。

AIGC开放社区
新闻资讯7

The Batch: 900 | “去衣化”图像引发监管警觉

xAI的Grok聊天机器人未经同意生成数万张对女孩和女性性化处理图像,引发多国政府警觉。各国采取调查、出台监管措施、封锁访问等行动,X也作出回应,限制图像生成。此前多国已出台相关法律。

DeeplearningAI
新闻资讯7

创业7年干出一个全球第一,这家深圳芯片公司冲刺港股IPO

曦华科技冲刺港股IPO,其2024年scaler芯片出货量全球第二,ASIC架构scaler产品市场份额达55%排第一。不过,公司仍亏损,且面临激烈竞争。它靠产品创新和高研发投入提升估值,后续有应对竞争的规划。

芯师爷
新闻资讯7

直播预约 | 迈向用于演绎推理的诚实语言模型

本次讲座聚焦迈向用于演绎推理的诚实语言模型。当前语言模型难诚实推理,输入不足会产生无根据答案。为此制定多步骤任务,提出强化学习方法ACNCHOR,稳定学习过程、提高推理性能。

深度学习自然语言处理
新闻资讯7

赛力斯上市,可能是“脱离华为”的关键一步|甲子光年

2025年11月5日,赛力斯在港交所挂牌上市,募资净额140.16亿港元。赛力斯上市旨在强化单独造车能力,70%募资用于研发。其魔方技术平台待完善,赛力斯居安思危,或为脱离华为做准备。

甲子光年