降本增效」共找到 586 篇相关文章

算法论文7

SMO | 西工大宁晨伽、张伟伟等:基于共享并行神经网络架构的多精度气动融合方法

高可靠性气动数据降本增效是关键命题。研究总结主流多精度建模方法,提出基于共享并行架构的融合策略,区分公共与私有特征,提升融合框架表征能力,还通过算例验证方法有效性。

力学与人工智能
新闻资讯8

DeepSeek如何实现5000亿估值?外媒曝其API毛利率高达82.9%

据外媒报道,DeepSeek今年前七个月营收约4.75亿,较2025年全年增长近10倍,净亏损收窄,综合毛利率44.6%,API业务毛利率达82.9%。它正磋商500亿二轮融资,筹备明年沪上市,靠优化基建,低价策略吸客。

AI前线
新闻资讯7

人民想念DeepSeek

文章探讨AI时代Token相关问题。指出其消耗大、价格贵,存储价格上涨使Token价缺杠杆,虽模型能力提升、MFU优化可,但传导到C端取决于商业考量。还回顾大模型价格战,介绍地部署及芯片创新方案。

芯师爷
推荐文章7

Cursor 重新定义 Agent:脑子再大,不如会翻书。

Cursor 分享博客指出,Dynamic Context Discovery 效果远好于 long context 方式,开启动态上下文可使总 Token 消耗 46.9%,还能减成延迟、提准确率,但也存在成转嫁、工程复杂度高和安全风险等问题。

探索AGI
新闻资讯7

7000 亿砸 AI,95% 失败:这一轮可能不会再造"电力时代"

文章指出轮 AI 革命与前几次不同,虽资大量涌入,但新需求少,多是和耗电。分析了其经济影响,如通缩压力、鲍莫尔病反转、K 型分化等,还给出个人发展建议。

AI Reading Hub
算法论文8

Qwen突破:用「并行计算」代替「堆参数」,新方法内存22倍、延迟6倍

LLM进化依赖「堆参数」,存在训练成高、推理慢等问题。论文提出ParScale,用「并行计算」代替「堆参数」,让模型「分头思考」,推理效率提升22倍,旧模型也能改造,落地价值大。

深度学习自然语言处理
算法论文8

算力成!马尔可夫思考机来了,LLM推理成直接为线性

用强化学习让LLM具备推理能力耗费颇高,计算量会二次级增长。Mila和微软研究院等团队提出马尔可夫式思考机,重构强化学习形式,让计算量呈线性,实验效果显著,还能与先进模型兼容。

机器之心
7

谷歌Gemini最强性价比模型发布,1块8读完3三体

谷歌推出Gemini 3.1 Flash-Lite,号称性价比最高的Gemini 3系列模型,每百万输入token仅0.25美元,读完3《三体》只需1.8元。性能表现佳,还支持可调思考层级。两小时后ChatGPT推出GPT - 5.3 Instant回应。

量子位
新闻资讯8

干货满载!腾讯云AI技术周圆满收官,回顾如何利用AI增效创收

2025腾讯全球数字生态大会启幕前夕,腾讯云联合InfoQ打造「AI技术周」,9月8 - 14日直播输出,围绕多关键议题邀大咖对话,公布多项AI+产品进展,涵盖搭应用、AI Agent落地、数据库智能进化等内容。

InfoQ
产品应用7

AI写代码终于不瞎烧钱了:边车路由让顶级性能成35%

传统模型路由用于写生产代码易掉链子,Cognition发布的Devin Fusion混合模型框架可解决该问题。官方测试显示,它能35%编码智能成且质量无明显下滑,从实际测试案例可看出其适用边界。

AI工程化