阿里淘天集团」共找到 667 篇相关文章

开源动态8

SGLang Hierarchical Sparse Attention 技术深度解析

阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了长上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段。

阿里云开发者
开源动态7

最强DeepResearch!通义DeepResearch-30B开源实战:模型部署+LangGraph+A2A全攻略

阿里发布全开源项目通义DeepResearch,在研究任务评测中表现出色,底层是30B的MoE专用推理模型,资源需求低。文章演示了基于该项目构建本地化端到端DeepResearch助理的方法,包括模型部署、Agent实现等。

AI大模型应用实践
产品应用8

刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架

8月大模型厂商多上调API价格或收缩免费额度,因推理需求增长跑赢算力供给。阿里发布Qwen3.8-Flash并开源,成绩亮眼且价格低。它是Qwen4架构预演,有四大技术创新,提升了模型效率。

机器之心
新闻资讯8

刚刚,林俊旸官宣创业公司Pragmatik Labs!

阿里千问技术负责人林俊旸官宣在上海创办新AI公司Pragmatik Labs,研究横跨数字与物理世界的下一代Agent。其获高榕创投、红杉中国领投,腾讯等支持,投后估值约20亿美元。

机器之心
开源动态8

LLM开源2.0大洗牌:60个出局,39个上桌,AI Coding疯魔,TensorFlow已死

9月13日蚂蚁集团开源团队发布LLM开源2.0全景图,收录114个项目,39个新晋、60个出局。生态洗牌,Agent层活跃,分类架构细化。AI Coding等领域发展显著,TensorFlow不敌PyTorch,还梳理厂商大模型发布情况。

机器之心
算法论文8

扩散语言模型扛把子LLaDA迎来新版本,数学、代码、对齐能力均提升

中国人民大学与蚂蚁集团团队基于前期 8B 扩散语言模型 LLaDA,提出方差缩减的偏好优化方法 VRPO,推出 LLaDA 1.5。它在数学、代码、对齐任务上性能提升,VRPO 为扩散语言模型对齐提供框架。

机器之心
开源动态8

ROLL:面向大规模语言模型的高效强化学习框架

本文介绍阿里推出的ROLL强化学习框架,专为LLM训练优化。它设计灵活,不同用户可用其满足业务、探索或线上指标需求。在多任务训练中性能出色,还采用创新机制提升效率,支持自定义操作,适合学术和业务场景。

阿里云开发者
推荐文章7

评估工程正成为下一轮 Agent 演进的重点

文章指出传统软件工程测试方法难用于 AI 系统,促使评估工程成 Agent 演进重点。它贯穿 AI 生命周期,正走向体系化。介绍评估工程发展阶段,还提及阿里云 RM - Gallery 和云监控 2.0 实践。

阿里云开发者
算法论文8

0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26

大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。

量子位
产品应用8

云栖大会演讲实录:Qoder 产品背后的思考与未来发展

这是云栖大会上关于 Qoder 产品的演讲实录。Qoder 是阿里推出的 Agentic 编程平台,上线一月收获数十万用户。介绍了 AI Coding 三阶段,阐述 Qoder 定位、功能模式、技术优势,展望 AI Coding 未来。

阿里云开发者