专有云测试」共找到 2176 篇相关文章

算法论文8

Claude团队用Qwen测试全新训练方法

Anthropic最新研究提出中训练(MSM),在预训练后、后训练前给AI立规矩。实验显示,新增MSM能让通义千问两款32B大模型失准率大幅下降,还能精简微调数据。MSM与对齐微调结合,可提升模型泛化能力。

量子位
7

大模型如何赋能 Web 渗透测试

文章指出传统Web安全检测有局限,而大语言模型(LLM)可提升漏洞发现覆盖率与准确性。以mcp server为基础介绍自动化漏洞检测方案,还分享实践操作、遇到的问题及解决办法,分析其优缺点并给出拓展思路。

阿里云开发者
新闻资讯7

别争了,OpenAI才是厂商的「最大甲方」

OpenAI与亚马逊达成380亿美元基础设施协议,将在AWS运行AI产品。AWS为其优化算力设施,预计2026年底全面部署,2027年后可扩展。OpenAI已签多项巨额合同,也引发AI泡沫担忧。

新智元
推荐文章8

突破泛化瓶颈:阿里智能运维 Agent 评测体系实践

大模型 Agent 在智能运维场景落地常遇泛化难题。阿里李也博士介绍利用评测集验证和提升智能运维算法泛化性的实践,阐述评测集重要性、构建方法,还展示其在提升智能运维 Agent 能力上的成效。

InfoQ
开源动态8

The Batch: 929 | Qwen3.5 超越更大模型,领跑视觉基准测试

阿里巴巴发布 Qwen3.5 系列,含 8 个开源权重的视觉 - 语言模型。其小模型表现超大体量 OpenAI 开源权重模型,在视觉任务中整体出色,部分在语言任务也有竞争力。虽团队有人员离职,但阿里承诺加大 AI 投入。

DeeplearningAI
产品应用7

Claude Code 学习最佳实践:NotebookLM 生成全套学习视频+卡片+测试

文章介绍用NotebookLM学习Claude Code的最佳实践。有人将36篇Claude Code资料“喂”给它,生成含音视频的学习资料库。NotebookLM能多种形式输出,支持多类型输入,值得纳入日常工作流。

AI进修生
开源动态8

高智商 ≠ 高财商?50天实盘测试:LMArena 高分王者也可能是「韭菜」

伊利诺伊大学厄巴纳 - 香槟分校团队开发 LiveTradeBench,让大模型在真实金融市场交易,检验其能力。它全面开源,有实时数据、组合决策等创新,50 天实测揭示模型财商差距。

机器之心
产品应用8

不上、不租卡,如何优雅地在本地微调Qwen-VL-30B?

文章指出企业训练多模态助手,30B 参数的开源多模态模型如 Qwen-VL-30B 是不错选择,但多模态场景下显存需求大。联想 ThinkStation PGX 解决了显存难题,还介绍其性能、优势、适用场景及服务等。

机器之心
产品应用8

360安全架构全解,AI智能体如何开启「主驾」新时代?

AI发展加速,网络安全危机加剧。360安全在ISC.AI 2025大会发布新产品,提出“安全即服务”理念,打造AI驱动的四层架构,发布三大类智能体,为企业提供全生命周期价值交付的安全服务。

甲子光年
开源动态8

Gödel Rescheduler:适用于原生系统的全局最优重调度框架

本文介绍字节跳动研发的Gödel Rescheduler重调度框架,它能解决传统调度资源分配和任务摆放问题。阐述传统重调度弊端,介绍新方案组件,列举应用场景及成果,还提及未来规划,目前已开源。

InfoQ