低内存」共找到 1179 篇相关文章

产品应用8

vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼

vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本,有精巧结构、高效策略,还有高质量数据和高性能平台支撑。

量子位
产品应用7

当AI从云端“下沉”,Arm如何赋能端侧

端侧AI发展近十年,已进入应用快速拓展期,成为推动消费电子革新重要力量,但面临视觉处理、内存平衡和应用迭代等挑战。Arm推出相关平台与技术,如SME2,提升AI性能与能效,还与厂商合作,持续创新赋能端侧。

芯师爷
产品应用8

多快好省,Qwen3混合部署模式引爆MCP

文章介绍Qwen3混合部署模式在MCP中的应用。MCP是AI与外部交互的标准协议,解决传统问题。Qwen3性能强、成本,有混合思维等特点。通过本地小尺寸和满血版结合部署,实现多快好省,但仍有资源消耗等不足。

阿里云开发者
新闻资讯7

百芯竞逐,芯片产业的“新战国时代”

ASIC发展超预期,成AI竞争胜负手。它适配大厂专属需求,成本与功耗,出货量和市场规模将扩容。英伟达GPU虽难替代,但份额会被ASIC蚕食,谷歌TPU已撕开其垄断裂缝,大厂纷纷自研ASIC。

芯师爷
算法论文8

量化噪声竟是RL秘钥?QeRL:高效强化学习新范式,一场噪声引发的性能革命

近年来,大语言模型在复杂推理任务中面临挑战,强化学习虽更接近人类推理过程,但训练“烧资源”。论文《QeRL》提出量化不仅能压缩模型、节省资源,还能增强模型探索能力,QeRL框架实现训练速度提升、内存占用减半。

深度学习自然语言处理
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极比特量化的三大挑战。

AI科技评论
产品应用7

00后下场整顿Agent:啥都不学就能用好AI,这才是正确打开方式

AI圈模型变强但使用门槛变高,00后团队打造的胖鹅AI以提示词为卖点,实测在生成视频、数据看板网页等方面表现出色。其核心是SOP体系,让AI适应人的习惯,降使用门槛。

量子位
新闻资讯7

一周休4天!老黄、盖茨站台,网友炸锅:是AI福利,还是裁员信号?

Fortune报道引发网友对3 - 4天工作制热议。Zoom CEO袁征、黄仁勋、比尔·盖茨等大佬认为AI或带来此转变,袁征觉得AI会自动化价值工作,也有人认为是裁员信号。黄仁勋称未来更忙,且有岗位消失也有新机会。

新智元
产品应用7

Anthropic 突发 Sonnet 5,但大家更期待 Fable 5 和 Mythos 5 明天解禁

昨夜凌晨,Anthropic 突然推出 Claude Sonnet 5,自封“性价比之王”。它重点提升计划制定等能力,价格更,安全性能提升,但网络安全能力弱于 Opus 4.8 和 Mythos 5。不过用户反馈平淡,Anthropic 面临高端模型受阻和访问控制争议等问题。

InfoQ
推荐文章7

从 Langchain 到 Spring AI,我们究竟需要怎么样一个企业级 AI 开发基础设施?

文章指出AI Agent应用开发方式演变快,企业构建AI Agent体系面临挑战。介绍了AI Agent应用架构变化及趋势,如AI应用平台代码效应、框架与平台双轨并行等,还总结了四类AI Agent框架及企业级框架平台核心考量。

phodal