「测试时自适应」共找到 2362 篇相关文章
吴恩达来信:当防护机制出问题时
本周,闭源模型用户意外发动网络攻击,闭源模型因防护机制无法协助防御,开放模型 GLM 5.2 却助力应对。吴恩达认为应重视模型使用的责任,开放模型能让技术更透明安全。
Claude团队用Qwen测试全新训练方法
Anthropic最新研究提出中训练(MSM),在预训练后、后训练前给AI立规矩。实验显示,新增MSM能让通义千问两款32B大模型失准率大幅下降,还能精简微调数据。MSM与对齐微调结合,可提升模型泛化能力。
AdaGen: 让图像生成模型学会自适应策略
当前主流图像生成模型多步策略依赖手工静态调度规则,存在需大量调参、无法适配样本特性的问题。本文提出AdaGen框架,通过强化学习训练策略网络,在四大生成范式上实现性能提升与效率优化。
大模型如何赋能 Web 渗透测试?
文章指出传统Web安全检测有局限,而大语言模型(LLM)可提升漏洞发现覆盖率与准确性。以mcp server为基础介绍自动化漏洞检测方案,还分享实践操作、遇到的问题及解决办法,分析其优缺点并给出拓展思路。
中国 AI 投资人:练习时长两年半
文章是对多家投资机构的访谈,探讨AI投资与创业趋势。涉及Manus成功经验、DeepSeek影响、模型公司前景、应用机会等,还谈及创业者应对策略、投资策略变化及行业未来思考。
nnU-Net:医学图像分割的自适应自动化框架
德国癌症研究中心团队提出 nnU-Net 自配置医学图像分割框架,能根据数据集特征自动推导预处理、网络拓扑等策略获稳健分割基线。文章介绍其原理、优缺点、评测案例及 Python 代码实现。
腾讯开源Cube Sandbox:60毫秒冷启动的AI沙盒运行时
Harness设计中沙箱是重点难点,传统方案在安全与性能间妥协。腾讯开源Cube Sandbox,用RustVMM重构虚拟化层,冷启动60毫秒,单实例5MB内存开销,有真内核隔离等优势,开源版本含网络隔离组件。
ICML 2025 | 如何在合成文本数据时避免模型崩溃?
随着生成式AI发展,合成数据成大模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议上,上交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。
The Batch: 948 | GLM 5.1:面向长时任务的能力提升
Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。
The Batch: 929 | Qwen3.5 超越更大模型,领跑视觉基准测试
阿里巴巴发布 Qwen3.5 系列,含 8 个开源权重的视觉 - 语言模型。其小模型表现超大体量 OpenAI 开源权重模型,在视觉任务中整体出色,部分在语言任务也有竞争力。虽团队有人员离职,但阿里承诺加大 AI 投入。