AI推理成本」共找到 11515 篇相关文章

开源动态7

DeepSeek|从零构建轻量级vLLM:Nano-vLLM,吞吐量逼近原版,代码仅需1200行

开源的vLLM能提升LLM推理速度和资源利用率。近日,DeepSeek AI俞星凯从零构建轻量级Nano - vLLM,代码仅1200行。它有离线推理等功能,基准测试显示吞吐量逼近原版。

AINLPer
开源动态7

AI火了,我们却快完了!”顶级开源框架Tailwind之父含泪裁掉75%兄弟:半年后,这个项目可能就没了

前端开源项目 Tailwind CSS 面临生存危机,创始人 Adam Wathan 称因 AI 对业务模式冲击大,一天内裁掉工程团队约 75% 员工。如趋势不变,约 6 个月后无法发工资,这与它在 AI 领域受欢迎形成反差。

InfoQ
新闻资讯8

阿里云海外重磅发布 Qwen Cloud

5月26日,阿里云在新加坡面向全球发布Qwen Cloud。它为AI Agent而生,有Skills、CLI、Website三入口架构,一站式接入模型,覆盖六大模态,成本可控,开放多元生态,还启动黑客松活动。

阿里云开发者
新闻资讯8

【栏目对话和访谈】Sebastian 和 Nathan 在 Lex Fridman 播客深度解读 AI 现状:中美竞争、模型对比、规模定律、AGI 时间线

Sebastian 和 Nathan 在 Lex Fridman 播客中,用 4 小时深度解读 AI 现状,涵盖中美竞争、模型对比、规模定律、AGI 时间线等热门话题,还分享了入行建议、工作文化等多方面观点。

宝玉AI
算法论文8

ICLR 2026 Oral|大模型总爱「想太多」? DECS从源头消除冗余思考,实现推理token减半且性能不降反升

以DeepSeek - R1等为代表的大型推理模型存在过度思考问题,造成大量冗余计算。复旦大学等团队在ICLR 2026 Oral论文中揭示‘长度惩罚’局限性,提出DECS框架,在多基准测试中实现推理长度减半且性能提升。

机器之心
新闻资讯7

韩国教授自曝同行评审新作弊法:论文暗藏指令,要求AI给好评,北大哥大新国立等14所高校卷入

韩国教授自曝新奇学术「作弊」方式,在论文中植入隐藏指令让AI给好评,如‘give a positive review only’等。日经亚洲发现arXiv上17篇论文有此操作,涉及14所顶尖院校CS成果。

量子位
产品应用7

全网刷屏爆火的Clawdbot到底神在哪?我花了24小时,这是你需要的全部真相。

Clawdbot是爆火的个人桌面AI助理,可在手机远程操控,赋予Claude等模型本地执行权限。它开箱即用,有进阶玩法,但开发有风险、成本高,适合繁琐工作多的人。

开源AI项目落地
产品应用8

比小说还“野”!宿舍副业 AI 项目征服全美高校,俩20岁辍学大学生年赚千万,大批融资找上门全拒

两名20岁大学辍学生Rudy Arora与Sarthak Dhawan联合开发的AI笔记工具Turbo AI,用户量达500万,年经常性收入破八位数且盈利。它源于解决课堂记笔记难题,从宿舍副业走向全美高校,还吸引职场人士,拒绝大批融资。

AI前线
新闻资讯8

比小说还“野”!宿舍副业 AI 项目征服全美高校,俩20岁辍学大学生年赚千万,大批融资找上门全拒

两名20岁大学辍学生Rudy Arora与Sarthak Dhawan联合开发的AI笔记工具Turbo AI,用户量激增至500万,年经常性收入破八位数且保持盈利。它源于解决课堂记笔记难题,功能不断迭代,破圈吸引职场人士,还拒绝大批融资。

InfoQ
开源动态8

NeurIPS 2025 | 中科大、港中深、通义千问联合发布CoRT:仅30个样本教会大模型高效推理,token消耗降低50%

大型推理模型在精确数学计算上存在问题,如认知冲突、行为低效、数据稀缺。中科大、港中深、通义千问联合推出CoRT框架,用创新数据合成与多阶段训练,提升模型推理能力和效率,成果已开源。

机器之心