安全体系」共找到 1462 篇相关文章

开源动态8

打破大模型编程「数据污染」与「能力虚胖」困境,Meituan-M17团队构建新一代AI编程评测新标准——OIBench

当前大语言模型编程能力评估体系问题多,如评测集饱和、数据泄漏等。Meituan - M17团队推出OIBench数据集,对18个主流大模型评测,揭示模型真实水平,还将举办人机协作编程竞赛。

机器之心
推荐文章7

一文看懂华为昇腾芯片

文章介绍华为昇腾芯片,它是面向高性能AI计算的NPU芯片,有昇腾310、910、610等系列。还提及芯片演进、参数、价格、出货量等情况,以及基于芯片的硬件体系,覆盖多场景满足不同需求。

芯师爷
产品应用8

AI无限生成《我的世界》,玩家动动键盘鼠标自主控制!国产交互式世界模型来了

昆仑万维带来交互式世界模型Matrix - Game,可让用户用键鼠探索创作虚拟内容。它发布了Matrix - Game - MC数据集、主模型和GameWorld Score评测体系,在多项评测中领先,还能在多领域发挥作用。

量子位
新闻资讯7

Fable第一,谁第二?Anthropic钦点8款模型名单曝光

Anthropic官宣Claude Fable 5全球上线,公布安全测试结果,8款模型包括中国的Kimi K2.7。北美公司也用行动认可中国模型,Kimi在多方面表现出色,其商业模式类似Anthropic,未来潜力大。

新智元
开源动态7

还需付费卸载龙虾?这只龙虾能直接「杀死」OpenClaw

OpenClaw曾引发安装热潮,如今因安全风险引发卸载潮。国家相关部门发布风险提示,网上出现卸载服务。而GenericAgent既能装也能卸OpenClaw,还能自我卸载,展现出硬核技术。

机器之心
算法论文8

不让“猪队友”拖后腿!哈深新作 AgentDropoutV2,专治多智能体“传话游戏”翻车现场

多智能体系统中,常有agent出错带偏整体。哈工大联合阿里提出AgentDropoutV2,测试时介入,设‘质检员’审核输出,结合失败案例构建‘避坑指南’,在多测试中显著提效,泛化性强。

深度学习自然语言处理
新闻资讯7

连肝36小时不睡!00后天才工程师,瘫坐特斯拉靠FSD保命

xAI工程师Parsa Tajik连续工作36小时后瘫坐特斯拉发X平台,同事纷纷叫好,马斯克也回应。xAI秋天忙碌,此前有裁员等情况。Tajik回应网友担忧,称拼车靠FSD安全回家。

新智元
新闻资讯7

Ilya、小扎之后,苏莱曼的「超级智能」进入7年倒计时!

主流AI公司从谈AGI转向「超级智能」。微软AI CEO苏莱曼宣布成立MAI超级智能团队,他定义的超级智能是人本主义的,重点布局三个领域,还面临安全可控等挑战,微软有7年窗口期。

新智元
新闻资讯7

Databricks与OpenAI合作:企业级私有化GPT-5来了

OpenAI和Databricks深度合作,将把GPT - 5等模型原生集成到Databricks平台。企业可在自有数据环境运行模型,通过SQL等调用,Mosaic AI Gateway保障数据安全,多家企业表示期待。

AI工程化
新闻资讯7

GPT-6 真要来了!OpenAI全新推理架构“循环深度”首次曝光:可榨出14倍参数潜能

OpenAI将推旗舰模型GPT - 6(内部代号Astra),采用“循环深度”新技术,能榨出14倍参数潜能,降低成本,但会使AI推理过程不可读,加重安全担忧。OpenAI已因该模型“能力过强”踩刹车。

InfoQ