Token调用量」共找到 1509 篇相关文章

算法论文8

破解MoE模型“规模越大,效率越低”困境!中科院自动化所提出新框架

大模型参数飙升却陷入‘规模越大,效率越低’困境,中科院自动化所研究团队提出统一框架,直击MoE底层运作模式,让专家‘组队学习’,实现参数、负载方差降低,达成三重优化。

量子位
新闻资讯7

人形机器人七小龙:谁真能卖,谁在讲故事?

2026年人形机器人行业融资热度高,宇树科技等七家公司被称为“人形机器人七小龙”。它们估值超百亿,各有特色,但技术未达天花板,商业化路径不清晰,面临国内外竞争,2026年是行业分水岭。

芯师爷
算法论文8

通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性能,硬件无缝支持

LLM.265研究发现,视频编码器是高效的大模型张编码器,现成视频编解码硬件压缩AI模型数据效率高。它灵活控制码率、可压缩多种张,还能利用GPU硬件加速。实验显示其压缩效果显著。

新智元
产品应用7

用 Ollama 本地运行 OpenAI gpt-oss 官方完整教程

OpenAI出教程教用Ollama本地部署gpt-oss-20b或gpt-oss-120b,可实现离线对话、API调用等。介绍模型版本、硬件要求、安装设置,还提及对话、API使用、工具调用、与Agents SDK集成等内容。

AI工程化
新闻资讯7

别高估车企“造人”

今年5月特斯拉停产后搭建Optimus产线,虽强调FSD算法可复用,却未产。车企造机器人,优势在供应链管理和生产制造,算法移植效果一般,且面临数据难题,竞赛中暂无通关密码。

远川科技评论
算法论文8

何恺明首个语言模型:105M参数,不走GPT自回归老路

何恺明团队推出全新连续扩散语言模型ELF,不走GPT自回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型。

量子位
开源动态8

MiniMax-M1:全球首个开源超长上下文大模型,超越DeepSeek-R1,推理成本仅1/4

MiniMax-M1是全球首个开源超长上下文大模型,刷新三项记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。

深度学习自然语言处理
新闻资讯8

陈大年复出,入局大模型

国产大模型领域黑马StartLux-V1.0-27B-Preview,参数仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数的DeepSeek-V4-Pro。其创始人陈大年押注本地模型,公司专注该领域商业化。

量子位
产品应用8

你们催更的模型,云栖大会一口气全发了!

云栖大会上新6款模型、发布1个全新品牌,覆盖多场景。如Qwen MAX万亿参数大模型能力登顶国际榜单,Qwen3 - Omni实现全模态不降智等,各模型能力升级显著,现已同步上线。

阿里云开发者
开源动态8

超长推理还能节省计算!Salesforce开源神器两连发:教大模型边想边省,显著提升数学编程准确率

Salesforce AI Research开源Elastic Reasoning和Fractured Sampling。前者将推理流程分两部分,分配token预算,使输出缩短、准确性提高;后者打碎推理链条,从三维度采样,以更少tokens换更高准确率,均提升数学和编程任务准确率。

量子位