「应用构建」共找到 3788 篇相关文章
一文看懂“存算一体”
文章介绍存算一体概念,它因传统冯·诺伊曼架构在数据爆炸、AI崛起下暴露“存储墙”“功耗墙”问题而提出。阐述其发展历程、技术路线、存储介质、应用场景,也指出技术、生态、市场方面挑战,前景潜力大。
从单领域到多能力协同:数据混合如何重塑AI的强化学习
上海AI Lab的OpenDataLab团队通过大规模实验剖析可验证强化学习(RLVR)在多领域推理中的机制,发现逻辑与数学数据相互支持、代码推理有跨领域混合效应等,为构建AI推理模型提供关键发现。
推理即排序:ReasonRank反常识的2.7倍效率跃迁,新SOTA比快更快
论文提出新型排序模型ReasonRank,将深度推理能力融入排序流程,突破数据瓶颈,采用创新训练框架,效率比主流点对点排序模型快2.7倍,还介绍方法论、技术突破、实验验证等内容,指出局限与未来方向。
PyTorch博客翻译 Accelerating Generative AI Part III: Diffusion, Fast
这篇博客介绍用纯原生 PyTorch 技术将文本到图像的 diffusion 模型(特别是 Stable Diffusion XL)推理速度提升高达 3 倍的方法,讲解五种优化技术,还验证了方法在其他 diffusion 模型上的通用性和有效性。
在WAIC耳朵听出茧子的「智能体」,是时候系统学一下了
今年世界人工智能大会上,智能体成主角,AI厂商纷纷布局。文章指出人们对AI大模型期望转变,介绍智能体底层逻辑,涵盖工具使用、推理模型、ReAct框架等,还对比先前尝试,探讨智能体能力层次与未来发展。
全国首部AI大模型私有化部署标准,公开征集起草单位和个人!
近期AI领域政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但面临诸多问题。由智合标准中心组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准立项,现征集起草单位和个人。
多模态后训练反常识:长思维链SFT和RL的协同困境
华为与香港科大研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。
别只盯着李飞飞!AI的「3D数据底座」已被这家中国公司悄悄建好
群核科技构建具身智能时代的「3D版ImageNet」,其SpatialVerse平台为机器人提供三维数据与仿真环境。借助新技术发布全球首个3D语义数据集InteriorGS,还与多机构合作,成果获学术和产业认可。
硬核「吵」了30分钟:这场大模型圆桌,把AI行业的分歧说透了
在WAIC 2025大模型论坛的“模型之问”圆桌中,多位行业大佬围绕大模型展开辩论,话题涉及训练范式、模型架构、数据、开闭源等核心问题,不同观点碰撞,深入探讨大模型技术演进与发展之路。
阿里 Qwen3:持续开源,SOTA 连连!
很多从业者有‘闭源模型一定比开源强’的刻板印象,而 Qwen 正打破此认知。最近阿里连发三款模型 Qwen3-235B、Qwen3-Coder、Qwen3-235B(Thinking),在多方向发力且拿下多个开源榜单第一。