成本低」共找到 2084 篇相关文章

新闻资讯8

AI 的下一个战场:端侧模型崛起

大模型退烧,小模型接棒。腾讯、阿里等大厂纷纷官宣小模型成果,英伟达、OpenAI 等也有相关动作。端侧模型赛道广阔,但技术含量不,面壁智能在端侧模型探索上成果丰硕,其 MiniCPM 系列不断迭代,还在多领域落地。

AI科技评论
新闻资讯8

GPT-5 终于发布:别慌、AGI 还没来,第一手的上手体验在这里

GPT-5 发布,距离 GPT-4 发布已过 2 年。它能力强、定价有竞争力,是首个「统一」AI 模型,幻觉率、代码能力强。免费用户可默认使用,Plus 和 Pro 订阅用户有不同使用额度。开发者可使用三种模式,代码能力测试案例可参考相关网站。

Founder Park
算法论文7

Reasoning模型可以Self-Train!

当前大模型依赖人类标注数据,成本高且扩展难。论文探讨模型自我纠错、自主进化可能,提出自我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。

深度学习自然语言处理
新闻资讯7

Anthropic最新博客:MCP没有死,我们又救活了。

2个月前Eric Holmes认为MCP已死,因其有Token成本等问题且LLM本就会用命令行。但本周Anthropic发博客称想清MCP定位,它不是替代CLI,而是覆盖其到不了的地方,还给出改进方案,MCP月下载超3亿次。

探索AGI
算法论文8

为什么GPT-5算得出微积分,却数不清积木?

文章对GPT - 5展开系统化空间能力测评,涵盖8个基准、超10亿token成本。提出“空间智能六维图谱”,发现GPT - 5在MM和SR达人类水平,但MR、PT等方面有短板,还揭示闭源与开源模型在复杂任务上差距小等情况。

深度学习自然语言处理
算法论文8

只需一次指令微调,大模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral

预训练大模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙大与Thomson Reuters团队提出SIMoE,单阶段微调就能升级大模型,还解决传统方法两大局限,在性能和效率上双突破。

量子位
算法论文8

都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了

当下推理模型流行在测试时多循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只多循环1次(共2次),就能大幅提升性能,继续增加循环次数,性能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。

机器之心
产品应用7

作业帮Flink On K8s落地实践

本文分享作业帮2025年Flink on k8s的探索与实践,包括选型思考、平台架构演进等关键内容。介绍了历史on Yarn模式的问题,阐述选型Flink K8s Operator模式的原因,还提及任务状态观测、环境资源成本等,分析核心问题并给出解决方案。

InfoQ
产品应用7

Agent从一问一答到自主执行面临哪些挑战?

随着AI发展,Agent正从答疑助手走向自动执行任务的数字人,定时调度是其走向自主运行的关键。开源Agent定时任务存在无高可用、运维成本高、权限管理弱等痛点,阿里云MSE AI任务调度有高可用、统一管理等优势,现免费公测。

阿里云开发者
7

OpenAI 广告续命遭全网骂,用户要跑路Gemini!需烧 400 亿,18个月破产预警

OpenAI计划在ChatGPT对话界面向美区免费版和价订阅用户测试广告投放,旨在拓展营收缓解成本压力。此举动引发批评,用户转向Gemini。OpenAI虽营收增长,但算力投入大,首席财务官称加广告会坚守三大原则。不过,有预测称其18个月内或破产。

AI前线