大模型成本」共找到 9737 篇相关文章

新闻资讯7

Redis 之父:哪怕被喷我也得说,AI 远远落后于人类程序员!开发者跟评:用模型气得我自己写代码都有劲儿了

Redis之父Antirez分享开发经历称人类程序员仍比模型出色,举例说明在解决Redis复杂bug时,人类的创造力能想出奇特有效的解法,而模型较难做到。开发者看法不一,有将其当助手,也有认为它会干扰思路。

InfoQ
算法论文8

Agent也能蒸馏了!性能超好

模型运行成本高,普通用户用不起。传统小模型模仿模型解题步骤易出错。论文提出Agent蒸馏,让小模型学会用检索和代码工具,还加首思前缀与自我纠错“外挂”,使小模型性能直逼模型

深度学习自然语言处理
开源动态8

小米MiMo-V2-Flash开源:3090亿参数模型能否改写AI行业规则!

2025年12月16日小米开源旗舰模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。

MCP Server
开源动态8

小红书hi lab首次开源文本模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
算法论文8

首个多轮LLM Router问世, Router-R1可让模型学会「思考–路由–聚合」

语言模型种类爆炸的时代,如何智能分配任务成新挑战。伊利诺伊学香槟分校团队发布 Router - R1,让 LLM 学会‘思考–路由–聚合’,用强化学习平衡性能与成本,在七基准测试表现出色。

机器之心
新闻资讯8

领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%

Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型成本低、速度快,有望革新模型扩展路径。

机器之心
产品应用8

懂方言,通诗词,精通30国语言,阿里发布语音识别模型Fun-ASR1.5

阿里发布语音识别模型Fun - ASR1.5,可精准识别30种语言,覆盖中文七方言体系及二十余种地方口音,强化古诗词诵读专项识别,后处理环节优化标点预测和文本归一化,降低人工成本

千问大模型
开源动态7

OpenAI解密模型失控:它不是变坏,而是「太听话」

OpenAI公开IH - Challenge,解决模型指令冲突难题。指出模型问题多因听信错误指令,给出系统>开发者>用户>工具的指令层级结构,设计数据集训练模型遵循高信任等级指令,提升安全可控性与抵御提示词注入能力。

新智元
产品应用8

1人顶1个Infra团队!OpenAI前CTO新招,让模型训练跌成白菜价

模型训练正从‘作坊炼丹’进化为‘工业微调’。OpenAI前CTO创立的Thinking Machines Lab推出Tinker,潞晨云微调SDK兼容其范式,实现算法设计与基础设施解耦,降低成本,提升人效,适用于多场景。

新智元
算法论文7

正确答案 ≠ 正确推理,CoT 或成模型推理能力停滞的「罪魁祸首」?

研究指出当前模型推理能力评估多关注答案准确性,忽视推理步骤。通过对前沿模型测试发现,2023 - 2024 年模型推理能力提升停滞,进步靠提示工程,自底向上策略最有效。

AI科技评论