端侧大模型」共找到 9153 篇相关文章

开源动态7

直播预约 | LightMem:面向模型的轻量化可插拔记忆系统

本报告聚焦语言模型长期记忆构建与轻量化机制。现有外部记忆系统有记忆臃肿、组织低效、更新代价高问题。为此提出LightMem架构,能为模型提供轻量、高效、可扩展记忆组件。

深度学习自然语言处理
推荐文章8

模型微调评测入门:看懂这些指标,才知道模型好不好

文章指出模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。

机器学习AI算法工程
推荐文章8

概是我读过关于AI模型最全面、好读又易懂的文章了

文章从神经网络入手,介绍其概念、学习过程,进而引出语言模型,阐述其原理、训练方法,还提及AI浪潮下基础设施及模型使用方式,如Agent、MCP等,展现神经网络和模型发展现状与前景。

腾讯技术工程
开源动态7

视频推理界的“福尔摩斯测试”:所有模型,统统不及格 | 论文代码开源

腾讯ARC Lab和香港城市学推出Video - Holmes,这是视频推理界的‘福尔摩斯测试’,能展现多模态模型复杂视频推理能力的边界,规避现有Benchmark痛点,测试中所有模型全部不及格,代码已开源。

量子位
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

近期AI政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但面临诸多问题。国内首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》立项,现征集起草单位和个人。

AI工程化
开源动态7

数千模型全跑「中国芯」!最后一公里已「焊」通

国产芯片运行模型需额外适配,魔乐社区以开源模型推理适配协作模式破局。它推出‘模型推理适配协作计划’,联合多方力量,打通国产算力与模型应用‘最后一公里’,还举办赛事激发创新活力。

新智元
算法论文8

清华&通院推出"绝对零"训练法,零外部数据模型自我博弈解锁推理能力

清华、北通院和宾州州立学研究人员提出“绝对零”训练法,让模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型超专家标注样本训练的模型,且能提升编程与数学推理表现。

量子位
开源动态8

模型陷入幻觉循环,如何用工程化给它“立规矩”?

普林斯顿和伯克利研究定义“机器胡扯”,指出模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为模型注入规则,还开源此框架,其在多行业场景应用效果良好。

InfoQ
新闻资讯7

AI 渗透金融行业:模型如何破解风控、服务与决策难题?

在数字化与人工智能驱动下,金融行业变革深刻。InfoQ《极客有约》X AICon 直播栏目邀多位专家探讨模型赋能金融,涉及风控、服务、决策等难题,分享了模型应用场景、技术渗透、权衡可解释性与性能等观点。

InfoQ
开源动态8

马斯克转发字节Seed&哥商学院新基准:模型搞金融,连查个股价都能出错

字节跳动Seed团队与哥商学院推出开源金融搜索与推理基准测试FinSearchComp,含635个问题。评测显示模型处理金融任务有差距,凸显金融AI能力评估重要性,还揭示了关键能力差距。

量子位