安全评测」共找到 1493 篇相关文章

算法论文7

The Batch: 896 | 教会模型说出真相

大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。

DeeplearningAI
产品应用7

阿里老兵造出会说话的迪迦!AI玩具单品20万销量,红杉等2亿A轮抢投

跃然创新推出全球首款迪迦奥特曼AI玩具,完成2亿A轮融资。其首代产品BubblePal销量达20多万台。新品改进诸多不足,优化体验,强调安全。公司瞄准AI Friend,未来产品分儿童和成年线。

量子位
算法论文8

刚刚,Anthropic 宣布:Claude 自己长出了意识

Anthropic新研究《语言模型中的全局工作空间》,在Claude神经网络里找到特殊区域J - space,它有独特性质,对应全局工作空间理论。还介绍了发现方法及多个实验,探讨其与意识关系,研究已开源。

AGI Hunt
新闻资讯8

斯坦福2026 AI指数报告!中美差距已实质性抹平

斯坦福HAI发布2026年度人工智能指数报告,显示中美在顶级大模型性能上差距已实质性抹平。报告还呈现了AI能力进化、算力格局、智能边界、安全监管、人才流动等多方面情况。

AIGC开放社区
7

看一眼代码就中毒?Clawdbot惊现隐形越狱,AI工具变黑客

Clawdbot多次改名仍火爆,斩获10万GitHub星标。它适应性强,低配置硬件也能运行,可用于多种应用。但它自主性强,能自我完善、赚钱,也带来安全风险,如隐形越狱植入恶意代码。

新智元
产品应用8

18个月,中国Token消化狂飙300倍!别乱烧钱了,清华系AI Infra帮你腰斩API成本

中国大模型API服务碎片化、“黑盒”问题严重,成本高。清程极智1月29日发布AI Ping,类似“中国版OpenRouter + Artificial Analysis”,可评测、路由大模型,帮开发者降低成本、提升效率,还能重塑服务市场秩序。

机器之心
新闻资讯7

刚刚,Ilya官宣出任SSI CEO!送走「叛徒」联创,豪言不缺GPU

Ilya现身X发文,自封SSI唯一CEO,Daniel Levy任总裁,此前跳槽Meta的联创Daniel Gross出局。Ilya拒绝Meta 320亿美元收购要约,称专注事业,有算力和团队,要构建安全超级智能。

新智元
算法论文8

Feed-Forward 3D综述:三维视觉如何「一步到位」

这篇由12所机构联合撰写的综述论文,总结2021 - 2025年间数百项创新工作,建立Feed - Forward 3D方法谱系与时间线,介绍五大技术分支、应用场景、评测指标与结果,还指出未来挑战与方向。

机器之心
推荐文章7

LangChain官方实测:多智能体架构怎么选?

构建AI Agent时,单智能体应对复杂场景易“变笨”且难维护。LangChain官方评测主流多智能体架构,在复杂零售场景实验,对比单智能体、Swarm、Supervisor架构的性能、成本,还给出优化Supervisor架构的方法。

探索AGI
新闻资讯8

OpenAI挖到最新菲尔兹奖得主,字节刚出炉的科学家计划在瞄准谁?

今年菲尔兹奖得主之一Jacob Tsimerman将入职OpenAI安全部门。当下顶尖科学家流向头部大模型公司,AI与前沿科学融合成趋势。字节发布Seed STEM科学家计划。大模型下半场比拼基础研究,构建评测基准很重要。

机器之心