全栈优化」共找到 3044 篇相关文章

算法论文7

苹果光速撤回RLAX论文:用了谷歌TPU和阿里Qwen,作者中还有庞若鸣

苹果一篇新论文在 arXiv 公开后匆匆撤稿。该论文揭示基于 TPU 的可扩展 RL 框架 RLAX,用了谷歌 TPU、亚马逊云及阿里 Qwen 模型,还介绍其架构、策略支持等,实验结果亮眼,也分享 Debug 过程。

机器之心
新闻资讯7

揭秘存储超级周期下的机遇与挑战

随着AI算力需求爆发与存储行业超级周期开启,存储芯片价格飙升,引发产业链连锁反应。这源于AI需求引发的结构性供需失衡,涨价将持续至2026年,还推动半导体产业结构升级。

芯师爷
开源动态8

告别VAE压缩损耗,南京大学用DiP让扩散模型回归像素空间,实现10倍加速与SOTA级画质

南京大学、腾讯优图实验室和新加坡国立大学发布DiP框架,即将开源。该框架不依赖VAE,仅增0.3%参数量,推理提效10倍,在ImageNet获1.79的FID分数,解决扩散模型在像素空间难兼顾质效的问题。

AIGC开放社区
开源动态8

Transformers来到了v5时代:从工具包到真理之源,AI时代的操作系统内核的极简进化论

Transformers v5发布,通过极简定义和极致互通成AI生态核心。它做减法重构代码、拓展训练流程、成推理引擎弹药库、提升量化为核心功能,连接训练、推理与部署,是AI生态通用语言。

AIGC开放社区
开源动态8

Mistral 3发布,14B多模态小模型表现优异

Mistral AI第三代模型发布,含三个小型密集模型和稀疏混合专家模型Mistral Large 3,用Apache 2.0许可。有多项技术亮点,Ollama等支持部署微调,还给出实用配置建议。

AI工程化
产品应用8

基于AI大模型的故障诊断与根因分析落地实现

文章围绕基于AI大模型的故障诊断与根因分析展开,介绍项目背景、目标与原理,阐述要解决的运维痛点及技术架构、知识库构建,还提及ReAct模式实现、Dify工作流及ClaudeCode对比,目前根因定位成功率有所提升。

阿里云开发者
推荐文章7

Claude Skills 写作指南:从0到1看完就会,不会来找我

本文介绍Claude Skills写作指南,指出传统提示词使用麻烦,而Skills能解决问题。阐述其适用场景、定义、原理,还讲了创建方法、作者实践及完整写作工作流,可按需管理提示词。

AI产品自由
新闻资讯8

马斯克悄然发布Grok 4.1,霸榜大模型竞技场所有排行榜

马斯克发布Grok 4.1,同时霸榜大模型竞技场第一和第二。它在思考与非思考模式表现出色,还在新专家榜和职业榜霸榜。此外,它在情商测试表现佳,还加强快速回复、改善幻觉问题,已向所有用户开放。

量子位
开源动态8

首个完整开源的生成式推荐框架MiniOneRec,轻量复现工业级OneRec!

中科大LDS实验室与Alpha Lab团队联合开源MiniOneRec,是生成式推荐首个完整端到端开源框架。它验证生成式推荐Scaling Law,可轻量复现OneRec,提供一站式训练与研究平台,技术优势明显。

机器之心
新闻资讯7

5亿热钱砸向具身智能新玩家!地平线VP创业,余凯又投了

具身智能赛道火热,无界动力获5亿天使轮融资。其创始人张玉峰是前地平线副总裁,团队实力强。此轮融资将加速基础模型研发与专家模型落地,公司首代机器人平台已在两方向突破。

量子位