「安全评测」共找到 1493 篇相关文章
60000小时炼出新开源VLA!20多种机器人都能用
蚂蚁灵波发布开源VLA模型LingBot-VLA 2.0,用60000小时预训练数据“喂”出。它支持20多种机器人构型,融合LingBot-Depth提升空间理解,还学会预测未来,在GM - 100评测表现佳。
Fable第一,谁第二?Anthropic钦点8款模型名单曝光
Anthropic官宣Claude Fable 5全球上线,公布安全测试结果,8款模型包括中国的Kimi K2.7。北美公司也用行动认可中国模型,Kimi在多方面表现出色,其商业模式类似Anthropic,未来潜力大。
还需付费卸载龙虾?这只龙虾能直接「杀死」OpenClaw
OpenClaw曾引发安装热潮,如今因安全风险引发卸载潮。国家相关部门发布风险提示,网上出现卸载服务。而GenericAgent既能装也能卸OpenClaw,还能自我卸载,展现出硬核技术。
高效智能体的「幕后推手」是谁?一篇综述带你从记忆×工具学习×规划看透
随着大模型能力提升,业界关注智能体落地,而高效性是决定能否上线的‘硬’问题。论文梳理‘高效智能体’综述,从记忆、工具学习、规划三机制出发,还谈及基准评测、挑战与展望。
连肝36小时不睡!00后天才工程师,瘫坐特斯拉靠FSD保命
xAI工程师Parsa Tajik连续工作36小时后瘫坐特斯拉发X平台,同事纷纷叫好,马斯克也回应。xAI秋天忙碌,此前有裁员等情况。Tajik回应网友担忧,称拼车靠FSD安全回家。
Ilya、小扎之后,苏莱曼的「超级智能」进入7年倒计时!
主流AI公司从谈AGI转向「超级智能」。微软AI CEO苏莱曼宣布成立MAI超级智能团队,他定义的超级智能是人本主义的,重点布局三个领域,还面临安全可控等挑战,微软有7年窗口期。
Databricks与OpenAI合作:企业级私有化GPT-5来了
OpenAI和Databricks深度合作,将把GPT - 5等模型原生集成到Databricks平台。企业可在自有数据环境运行模型,通过SQL等调用,Mosaic AI Gateway保障数据安全,多家企业表示期待。
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多问题模拟复杂推理场景。结果显示,DeepSeek - R1等模型高压下性能大幅缩水,REST能拉开不同模型差距,还揭示评测方法局限。
GPT-6 真要来了!OpenAI全新推理架构“循环深度”首次曝光:可榨出14倍参数潜能
OpenAI将推旗舰模型GPT - 6(内部代号Astra),采用“循环深度”新技术,能榨出14倍参数潜能,降低成本,但会使AI推理过程不可读,加重安全担忧。OpenAI已因该模型“能力过强”踩刹车。
人类研发时代结束?XYZ最强Search Agent横扫七大榜单,300个Agent跑通AI4AI全栈闭环
近日,XYZAI Lab发布两款Deep Search Agent,刷新多项评测SOTA成绩。其背后是新型AI4AI研发范式,让AI驱动研发闭环。XYZ团队用AI解决多方面问题,在Deep Search验证,未来有望拓展更多场景。