技术方案商」共找到 3529 篇相关文章

算法论文8

中科大 × 华为联合突破!SparseRM:1% 参数实现 LLM 偏好建模高效革新

中科大与华为联合提出SparseRM轻量级偏好建模方案,基于稀疏自编码器构建低参可解释奖励模型。实验显示它用不到1%可训练参数,在多任务中性能优,还能融入下游对齐流程,为LLM高效对齐提供新可能。

深度学习自然语言处理
产品应用8

智谱AutoGLM上线:给每个手机都装上通用Agent,AI从"对话"走向"操作"的里程碑

智谱AI上线AutoGLM,这是全球首个手机通用Agent,能让AI操作手机完成复杂任务。其技术架构强大,在多方面表现优异,与其他AI助手相比优势明显,还推出情感语音模型GLM - 4 - Voice,正推动大模型落地AI手机。

AIGC开放社区
开源动态8

离谱……面壁让 AI 写了个训练框架,然后它自己训出了最强的 1B 模型:MiniCPM5-1B

面壁发布 1B 参数量级最强端侧文本大模型 MiniCPM5 - 1B,其 Base Model 由 AI 编写的训练框架 ForgeTrain 训出,速度超英伟达 Megatron 10%。该模型性能出色,部署门槛低,数据治理方案对应数据集也已开源。

AGI Hunt
新闻资讯7

英伟达为何持续押注VASTData?AI存储正在成为新的“算力”|甲子光年

AI产业曾聚焦GPU,如今数据存储设施重要性凸显。VAST Data完成约10亿美元F轮融资,估值300亿美元,英伟达持续跟投。它重构AI数据基础设施,国内焱融科技有相似技术路线且具自主可控优势。

甲子光年
算法论文8

VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确

纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。

AIGC开放社区
开源动态8

Meta联手UCSD发布DeepConf:计算成本暴降85%,99.9%准确率!

Meta AI联合UCSD推出DeepConf技术,解决了AI高难度推理准确率与计算成本的难题。它让AI学会“察言观色”,筛选靠谱推理路径,在AIME 2025竞赛中与GPT - OSS - 120B模型取得99.9%准确率,还节省大量计算资源。

AIGC开放社区
算法论文8

一种基于滑动层合并的高效深度修剪大模型的方法

文章指出深度修剪可加快推理速度,但直接丢层会降低性能。为此提出滑动层合并法,根据相似度阈值融合连续层,简化结构且保持性能。实验显示该方法优于现有技术,还揭示了与宽度修剪结合的潜力。

机器学习AI算法工程
产品应用7

Agentic 应用时代,Dify 全链路可观测最佳实践

文章讲述 Dify 平台在 Agentic 应用开发的可观测性挑战,从开发者与运维方视角分析现状、局限与改进方向。云监控推出全景可观测方案,还介绍各组件监控接入步骤及实践指南,最后提及 Qwen - Image 生图优势。

阿里云开发者
新闻资讯7

Win11 已近乎“残废”?微软承认多个核心功能崩盘,锅要甩给 AI 编程吗?

近期微软麻烦不断,先是部分Microsoft 365服务故障,Windows业务负责人公布的计划也遭不满。英伟达指出Windows 11更新影响游戏效能,微软承认其存在系统性问题,多个核心功能故障已持续四个月,官方正修复并给出临时方案,引发社区吐槽。

InfoQ
开源动态8

罗福莉执掌小米大模型首秀!定调下一代模型,全新MiMo-V2开源还横扫Agent第一梯队

在2025小米人车家全生态合作伙伴大会上,罗福莉首秀解读全新大模型MiMo - V2 - Flash,该模型已开源,采用MoE架构和MTP技术,在多方面表现出色,罗福莉还阐述其设计逻辑与对下一代智能体的看法。

AI前线