「AI安全评估」共找到 10444 篇相关文章
谷歌的Agent小镇被Moltbook超预期实现了
斯坦福&Google曾构建虚拟小镇,让25个智能体在沙盒自主生活,愿景是构建可信人类行为模拟智能体。如今Moltbook超预期实现此愿景,超150万个AI Agent形成数字文明雏形,且实现方式与预期不同。
音乐新王震撼降临,Al音乐进入格莱美时刻
2026开年,MiniMax Music 2.5发布,凭「格莱美级」音质、极致拟真人声开创AI音乐新高度。它消除中文演唱「洋味儿」,支持14种结构标签精准控制,让音乐制作门槛降低,从C端娱乐迈向B端生产力。
清华孙茂松团队 × 深言科技:以解释作为训练信号,让 8B 模型在幻觉检测上反超闭源大模型
大语言模型幻觉问题待解,成本与算力需求攀升。清华孙茂松团队联合深言科技提出FaithLens模型,把幻觉检测提升为整体评估,以解释作为训练信号,8B模型在多任务上超闭源大模型。
英伟达推出下一代计算平台Rubin:可用45°C的热水进行冷却,训练速度提高3.5倍
英伟达黄仁勋在CES演讲,宣布进入自动驾驶领域、推出Alpamo模型与下一代计算平台Rubin。他指出计算行业正经历平台性转变,还介绍AI进展、应用架构,Rubin平台性能强且能效高。
刚刚,OpenAI发布GPT-5-Codex:可独立工作超7小时,还能审查、重构大型项目
凌晨1点,OpenAI发布针对编程优化的GPT-5-Codex,它能独立工作超7小时,可审查、重构大型项目。还宣布Codex升级,包括新CLI和IDE插件等,同时介绍安全保护措施、价格及可用性。
全球第一!西湖大学成功登顶Science,卷赢同行背后黑科技揭秘
西湖大学一篇论文登顶Science,力压4篇同主题投稿。其成功除科研人员实力,还靠曙光存储支持。曙光为其AI集群升级,提供单节点带宽150GB/s的存储方案,且已大规模落地科研领域。
刚刚,Claude 可以主动终止对话了……
Anthropic宣布给Claude Opus 4和4.1赋予主动终止对话能力,这是潜在AI福利探索工作一部分。因用户辱骂或提有害要求时Claude有类似“痛苦”反应,此功能极端情况才用,社区对此看法不一。
ChatGPT会让大脑退化?OpenAI高管用它救下自己「读写障碍」的女儿
OpenAI将ChatGPT视为学习平台,致力于弥合教育鸿沟。其学习模式把ChatGPT变为引导学生找答案的导师,能实现平等学习机会。在教育中,如何使用AI很重要,它还拯救了高管读写障碍的女儿。
GPT-5 放弃追求智能上限了?
GPT-5发布,虽借OpenAI名气获流量,但AI科技评论认为其结果令人失望。它推销转向任务性能提升,非基础大模型能力突破。虽成果出色,但也引发对AGI发展的反思,还面临诸多难题。
只训练数学,却在物理化学生物战胜o1!新强化学习算法带来显著性能提升,还缓解训练崩溃问题
上海创智学院、上海AI Lab的MM - Eureka系列工作提出新强化学习算法CPGD,缓解训练崩溃问题,提升性能。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。