端侧小模型」共找到 8118 篇相关文章

产品应用8

震惊海外开发者!BOSS直聘3B模型比肩80B,怎么做到的?

BOSS直聘楠北阁团队发布3B轻量端侧小模型Nanbeige4.1-3B,性能震惊海外开发者。团队从多方面改进,如优化推理和偏好对齐,重构训练数据,采用多种强化学习算法,使其性能比肩大模型

AIGC开放社区
开源动态8

AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒

清华大学等联合研发的 AgentCPM-Explore 智能体模型,基于 4B 参数在深度探索类任务表现出色,有打破参数壁垒等亮点,还全流程开源,解决模型性能提升挑战,邀伙伴共建端侧智能体生态。

AIGC开放社区
新闻资讯7

智谱 GLM-4.5 团队深夜爆料:上下文要扩、模型在路上,还承诺尽快发新模型

今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推模型是重点,还承诺尽快发新模型,也探讨了大模型发展观点。

AI前线
算法论文7

英伟达放话:模型才是Agent的未来!

英伟达论文指出,当前用大模型构建AI Agent是资源浪费,提出模型才是Agentic AI未来,给出三点理由,还提供从大模型迁移到模型的六步流程,并分析三个开源项目,呼吁行业追求效能。

探索AGI
产品应用8

0.3B参数,600MB内存!腾讯混元实现产业级2Bit量化,端侧模型如手机App

腾讯混元团队推出面向消费级硬件的“极模型HY-1.8B-2Bit,参数量仅0.3B,内存占用600MB。它基于产业级2Bit端侧量化方案,生成速度提升,还通过多种方法提升能力,未来将探索新技术缩与全精度模型差距。

量子位
新闻资讯7

忘掉大模型,微软实证:模型才是Agentic AI的未来!

过去两年大模型在数学竞赛题上靠Test - Time Scaling发展遇天花板。微软rStar2 - Agent让14B模型学会‘写代码→跑结果→改思路’,表现出色。还介绍了其基础设施、算法、训练配方等方法。

PaperAgent
算法论文8

英伟达发布 Jet-Nemotron 系列模型,理论最大加速比 56 倍

英伟达发布 Jet - Nemotron 系列模型,在多项基准测试中表现出色,实现高吞吐量加速和高准确率。其训练采用 PostNAS 方案,对既有模型针对性优化,展示了在模型优化上的可行技术路径。

AI科技评论
算法论文7

英伟达说,语言模型(SLM)是智能体的未来

英伟达论文指出语言模型(SLM)是代理人工智能未来。SLM参数于100亿,可装在消费电子设备。英伟达认为其强大、适合代理系统且经济。微软、英伟达等多家厂商的模型表现出色,文中还分析了SLM优势及代理架构。

AI与安全
算法论文7

英伟达新研究:模型才是智能体的未来

英伟达最新论文指出,大模型在Agent任务中消耗大量计算资源,成本高、效率低、灵活性差,而模型能在性能够用前提下让任务执行更经济灵活。模型通过优化硬件资源和任务设计高效执行任务,但落地面临挑战。

量子位
算法论文8

年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:模型“套出”大模型隐藏思维链,Kimi-K3重现概率异常

这篇论文指出三大前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复大模型隐藏思维链数据。还揭示部分模型训练或借鉴大模型思维链,此漏洞也致企业数据隐私安全问题。

AI前线