大模型部署」共找到 9446 篇相关文章

开源动态8

8B 端侧写作智能体 AgentCPM-Report 开源,DeepResearch 终于本地化

1月20日,8B端侧写作智能体AgentCPM - Report开源。它以端侧模型为核心,实现本地化部署与SOTA性能双重突破,亮点在于极致效能、本地安全保障,在多评测基准表现出色,部署便捷,两创新支撑其优秀性能。

InfoQ
新闻资讯8

姚顺雨对着唐杰杨植麟林俊旸贴脸开讲!基模四杰中关村论英雄

清华发起AGI - Next前沿峰会,智谱唐杰、Kimi杨植麟、阿里林俊旸、姚顺雨等咖齐聚。他们探讨AI发展方向,如唐杰认为Chat阶段结束,应走向做事;杨植麟强调做模型要创造世界观;林俊旸介绍千问进展,还讨论了路线分化、自主学习等话题。

量子位
新闻资讯8

商汤分拆了一家AI医疗公司,半年融资10亿,剑指“医疗世界模型

商汤分拆AI医疗公司,半年融资10亿。其以自研“医®”为核心构建医疗世界模型,形成闭环。推出智慧医院方案,临床、决策、患者端等多方面落地成果丰富,还布局海外市场,未来想让AI从文本到模拟决策。

量子位
算法论文8

ICLR 2026!代码优化不再靠玄学:模型真正学会“又快又准”,效率提升71.06%,加速比达6.08x

ICLR 2026顶会文章提出全新模型代码优化方案,切入代码优化核心难题。该方案将代码优化率提至71.06%,加速比达6.08x,正确性提至74.54%,有很强工程可用性。

AINLPer
新闻资讯8

领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%

Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革新模型扩展路径。

机器之心
新闻资讯7

利润腰斩也要卷AI!小米模型永久降价99%,雷军还要再砸600亿

今日小米宣布 MiMo-V2.5 系列 API 永久降价,最高降 99%,Token 额度提升。虽 2026 年 Q1 财报显示利润腰斩、营收下滑,雷军仍称今年 AI 投 160 亿,未来三年投 600 亿。此前 DeepSeek 也已降价,中国模型在 OpenRouter 表现亮眼。

AI前线
算法论文8

视听分离SOTA提速6倍!清华发布首个6M高性能模型|ICLR'26

清华学团队推出Dolphin模型,仅用6M参数,通过离散化视觉编码和热扩散注意力机制,实现单次推理精准分离语音,速度提升6倍以上,在多项基准测试中刷新纪录,为端侧设备部署开辟新路。

新智元
算法论文8

机器人的「GPT时刻」来了?丰田研究院悄悄做了一场最严谨的VLA验证实验

丰田研究院(TRI)团队研究型行为模型(LBM),在近1700小时机器人数据上训练并部署评估。发现LBM性能提升显著,预训练小数据量也能带来增益,预示机器人通用模型或到来。

机器之心
产品应用8

3B激活参数!商汤绝影Sage登顶PinchBench,端侧第一

商汤绝影Sage端侧模型在PinchBench评测中,以94%任务完成率超越Claude、GPT - 5.4等主流模型。它激活参数仅3B,算力需求低,还具备多项实用场景能力,靠SCOUT和ERL两项自研技术提升性能。

新智元
开源动态8

9.1K Star 调参师集体失业!亚马逊造出机器学习“核弹”,3行代码打造高精度模型

在机器学习普及的当下,自动化机器学习框架降低开发门槛。AutoGluon由AWS AI开发并开源,仅3行代码就能训练和部署高精度模型,支持多类型数据,有诸多亮点,已获9.1K Star。

开源星探