港大」共找到 5104 篇相关文章

算法论文7

关于多模态模型Token压缩技术进展,看这一篇就够了

多模态模型跨模态融合带来高计算成本,催生MLLM Token Compression研究。北等机构人员基于压缩位置对方法系统归类,讨论特定场景压缩机制选择,还探讨了挑战与前景方向。

机器之心
算法论文8

首个GUI多模态模型智能体可信评测框架+基准:MLA-Trust

MLA-Trust 是首个针对 GUI 环境下多模态模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。

机器之心
开源动态8

告别直接生成,文生图进入Agent时代:中文联合伯克利开源Gen-Searcher

过去文生图多是‘直接出图’,遇真实世界知识等易翻车。中文等团队提出Gen - Searcher,让图像生成模型像Agent一样搜索等,数据、模型和代码均已开源,实验显示它提升了生图准确性和质量。

机器之心
开源动态8

猛涨25k star!一键检测你的电脑能跑哪些模型!

最近 Github 出现工具 `LLMFit`,用 Rust 编写,能自动检测硬件配置,判断模型能否流畅运行,推荐最优量化版本和运行模式。有一键硬件检测等特性,安装使用方便,降低本地部署门槛。

开源先锋
算法论文7

拆解模型几项核心操作背后的数学与 Infra 优化逻辑

文章拆解模型核心操作(RMSNorm、Softmax、Causal Mask、Sampling)背后的数学与Infra优化逻辑。指出Infra优化是用数学等价变换或精度妥协换硬件利用率和推理速度,还介绍各操作原理、问题及优化方法。

腾讯技术工程
算法论文8

高瓴-华为诺亚:语言模型智能体记忆机制的系列研究

中国人民学高瓴人工智能学院与华为诺亚方舟实验室聚焦语言模型智能体记忆能力,形成含综述论文、数据集和工具包的研究体系。探讨记忆概念、重要性、实现与评测方法,还构建评测榜单、实现工具包。

机器之心
8

重磅发现!模型的「aha moment」不是装腔作势,内部信息量暴增数倍!

中国人民学等联合团队研究发现,模型推理有“信息脉冲”,特定步骤互信息值飙升形成“互信息峰值”,对应“思考词汇”。基于此提出无需额外训练提升推理性能的方法,代码已开源。

机器之心
开源动态8

利用模型从开源情报中自动提取检测规则:LLMCloudHunter,有开源

随着网络攻击增加,威胁情报成主动安全关键。以色列本古里安学发布LLMCloudHunter框架,用模型从开源情报自动生成检测规则,评估显示其规则质量高,且部分能编译成Splunk查询,软件已开源。

AI与安全
推荐文章8

模型推理加速全链路:内存管理、编译优化、量化与并行策略

本文整理自金煜阳博士在QCon会分享。介绍模型推理挑战,如规模增、架构复杂。阐述算子优化、内存管理、量化、异构调度和并行优化方法,还介绍开源推理引擎赤兔在国产芯片的实践成果。

InfoQ
推荐文章8

AI模型开发核心技术栈:从框架到部署的全景解析

本文为开发者提供2025年AI模型开发核心技术栈图谱,解析四核心支柱技术。基础开发框架含深度学习与AI Agent框架;模型训练与微调有分布式训练、参数高效微调;推理优化含关键技术与主流框架;AI编程辅助工具分主流形态且有发展趋势。

AIGC开放社区