成本降低」共找到 2042 篇相关文章

新闻资讯8

叛变!OpenAI亲儿子竟然选了Kimi K3

OpenAI投资的法律AI公司Harvey,首个自研模型Harvey Tenet选中国开源模型Kimi K3作底座。因原用闭源模型成本高、有竞争风险。Tenet训练成本低、性能佳,显示出可复制路径。

新智元
7

AI不需要海量用户

AI和互联网逻辑不同,互联网需海量用户,因其边际成本趋近零且是消费驱动。而AI有真实边际成本,是生产驱动,更需要重度用户。若用互联网打法做AI,会陷入产能黑洞,拖慢发展。

newtype AI
开源动态8

刚开源仅3天狂揽4.9K star,轻量超高效版OpenClaw,10美元硬件就能跑!

OpenClaw火遍全网但硬件要求高、成本不菲。新开源的PicoClaw是其轻量替代方案,由Sipeed开发,内存占用少、启动快、成本低、便携性强,安装简单,功能多样,刚开源就成热议新星。

开源先锋
开源动态7

Glyph:文本转图片解决长上下文困境,智谱把“DeepSeek-OCR”具像化了

传统 token 扩展方式遇算力成本天花板,DeepSeek 与智谱都想到让 AI“看”文字思路。智谱发布 Glyph 框架工程化实现此思路,将文本转图片处理,降低计算成本,有不错效果但也存在排版敏感等限制。

AI工程化
推荐文章7

Cursor 重新定义 Agent:脑子再大,不如会翻书。

Cursor 分享博客指出,Dynamic Context Discovery 效果远好于 long context 方式,开启动态上下文可使总 Token 消耗降 46.9%,还能减成本、降延迟、提准确率,但也存在成本转嫁、工程复杂度高和安全风险等问题。

探索AGI
产品应用8

传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!

大模型上线部署时推理成本高、算力投入大但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 大语言模型推理框架性能极致,成本低,集成关键创新,还被集成到 AI 云原生推理套件 ServingKit 中。

机器之心
开源动态8

英伟达巧用8B模型秒掉GPT-5,开源了

英伟达携手港大开源Orchestrator-8B小模型,在HLE测试中分数超GPT - 5,成本低且速度快。它靠ToolOrchestra训练法,协调工具解题。此赛道已有多项研究,小模型实用优势明显。

量子位
新闻资讯7

创始人跑路一年后,员工接盘把这家AI公司干到年入破亿!如今想含泪甩卖:真的“难以承受”

曾红极一时的AI聊天机器人公司Character.AI苦于运营成本高昂,正权衡出售或筹集新资金。创始人离职后员工接管,虽月活超2000万、预计年底年收入达5000万美元,但成本难承受,还面临监管和竞争压力。

InfoQ
算法论文8

Agent也能蒸馏了!性能超好

大模型运行成本高,普通用户用不起。传统小模型模仿大模型解题步骤易出错。论文提出Agent蒸馏,让小模型学会用检索和代码工具,还加首思前缀与自我纠错“外挂”,使小模型性能直逼大模型。

深度学习自然语言处理
推荐文章8

内核级的真相:为什么 eBPF 正在取代基于用户空间的 Agent 成为安全可观测性的首选

文章指出基于用户空间的安全 Agent 存在与威胁同权限层级、CPU 成本高、易被攻击等问题。eBPF 能在 Linux 内核运行受沙箱保护程序,可降成本、增可见性。上线应分阶段,还介绍工具及部署安全措施。

InfoQ