开源攻击框架」共找到 4255 篇相关文章

开源动态8

微软、哈佛开源创新优化器:全面超越Muon,提升大模型训练效率

随着大模型训练所需计算资源爆炸式增长,微软和哈佛团队联合开源优化器Dion。它利用低秩近似和解耦动量缓冲区,避免分布式训练同步完整梯度,在集中式和分布式场景都有高效表现,性能超Muon。

AIGC开放社区
新闻资讯7

老外给中国 AI 开源厂商打分:第一梯队是 DeepSeek 和 Qwen。

Nathan Lambert发布“中国开源模型开发商排名”,评估19家实验室贡献,第一梯队是DeepSeek和Qwen。还介绍字节跳动豆包、小米、百度文心一言发展情况,如豆包月活全球第二,小米模型效率突破,文心一言企业应用领先。

AI进修生
产品应用8

阶跃星辰发布新一代基模 Step 3,原生多模态推理模型,性能达到开源 SOTA

WAIC 2025期间,阶跃星辰上线新一代基础大模型Step 3,7月31日将面向全球开源。还成立“模芯生态创新联盟”,与上海国有资本投资有限公司合作。Step 3性能达开源SOTA,推理效率高,适配多种芯片。

Founder Park
开源动态7

三个月、零基础手搓一块TPU,能推理能训练,还是开源

加拿大西安大略大学工程师暑期打造开源 ML 推理、训练芯片 TinyTPU。他们非专业出身,从基础学起。还介绍了造 TPU 原因、硬件知识、构建方法,及推理、训练的实现。

机器之心
开源动态7

24张图,从GPT-2到gpt-oss,看OpenAI开源模型技术演进

2025年8月OpenAI释出gpt-oss-20b与gpt-oss-120b两个开源权重模型。文章梳理了从GPT - 2到gpt - oss的技术演进,拆解关键创新点,对比了与Qwen3的差异,介绍训练推理细节、实测体验及与GPT - 5跑分对比情况。

PaperAgent
开源动态8

让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方

上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。

OpenMMLab
算法论文8

二元成功率已经过时!PRM-as-a-Judge才是你需要的具身操作评测框架

传统二元成功率评测具身操作任务有局限,难回答策略推进、执行效率等问题。中科院自动化所等机构研究人员提出PRM - as - Judge框架,含进度势能、OPD指标体系和RoboPulse基准,能细粒度审计执行过程。

机器之心
开源动态8

视觉强≠能干活!清北普林斯顿等开源WorldArena,世界模型评测被颠覆

2026 年 2 月 13 日,清华、北大等顶尖机构联合推出的 WorldArena 面向全球开源。这是首个‘功能 + 视觉’统一评测体系,撕开了‘美丽视频’伪装,让评测从‘审美导向’走向‘功能导向’。

机器之心
开源动态8

兼顾效率、成本与能力,百灵开源旗舰推理模型 Ring-2.6-1T

5月15日,蚂蚁百灵开源旗舰级推理模型Ring-2.6-1T,权重文件上线Hugging Face、ModelScope平台。该模型有万亿参数,‘按需思考’,在代理执行、推理机制、训练范式三方面升级,评测表现出色。

AI前线
开源动态7

画个图就能管理知识?这个开源工具把笔记和画板合二为一了

作者发现开源工具Revezone,它将白板和笔记合二为一,解决图文割裂问题。有Excalidraw、Tldraw白板及类Notion笔记功能,还支持拖拽分屏。提供线上和桌面版,适合多类人群,优势明显且免费。

小华同学ai