「AI推理成本」共找到 11560 篇相关文章

算法论文8

DPad: 扩散大语言模型的中庸之道,杜克大学陈怡然团队免训推理加速61倍

扩散大语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克大学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。

机器之心
新闻资讯7

Meta宣布AI研究架构调整,成立TBD Lab,取消AGI Foundations团队,强化超级智能战略

Meta进行AI研究架构大重组,将业务分为研究、训练、产品和基础设施四个团队。成立TBD Lab探索新方向,如构建‘omni’模型;FAIR成创新引擎;解散AGI Foundations团队。旨在强化超级智能战略。

AGI Hunt
7

半数清华,8位华人AI天团集体投奔Meta!奥特曼:砸钱抢人不如培养死忠

硅谷人才争夺战升级,Meta砸3亿美元疯狂挖角,众多核心研究员投奔。OpenAI则推进‘驻留计划’,培养跨界人才,成本低、能植入文化、忠诚度高,这场人才战影响AGI时代走向。

新智元
算法论文8

X上63万人围观的Traning-Free GRPO:把GRPO搬进上下文空间学习

年初 DeepSeek - R1带火大模型强化学习,GRPO成常见RL算法,但训练成本高。腾讯优图论文提出Training - Free GRPO,将GRPO训练范式迁移到上下文学习,成本低、泛化好,已开源。

机器之心
新闻资讯7

三星按下一场史上最长罢工,但揭下了AI时代贫富差距的遮羞布

三星员工因薪资分配问题拟罢工,后达成临时协议,但其他业务部门不满。AI 推动 HBM 需求暴涨,其市场被少数厂商垄断,技术演进依赖多领域突破。国产存储厂商有机会借供不应求切入市场,长鑫和长江存储传 IPO 进展。

InfoQ
产品应用7

Skill Factory:三天手搓面向Harness设计的技能工厂(附AI coding实践)

作者分享从产品设计到算法落地全流程实践,指出当前做skill两种方式的问题,介绍面向Harness设计的技能工厂,包括生产模式、生态适配、迭代方向,还提及AI coding实践及各工具作用。

阿里云开发者
新闻资讯7

阿里开启 Token 战略,喊出云+AI 年收入破千亿口号,底气从哪来?

3月19日晚,阿里在财报电话会提出未来五年云与AI商业化年收入破1000亿美元目标。过去三月,阿里云Token消耗涨6倍,自研芯片交付47万片,还提价。其正从‘用户红利’转向‘Token经济’,有望‘量价齐升’。

Founder Park
新闻资讯7

Token 降价的尽头,是一度电的账

AI进入算账阶段,Token成本成系统工程。优刻得董事长季昕华认为Token终局是电力,降本需选好数据中心、用国内模型等。企业要解决AI投入产出衡量问题,Token需求会持续增长,优刻得定位中立服务平台。

InfoQ
算法论文8

西交大 x A*STAR 论文:让 AI 学会「保持一致」,多图生成迎来关键突破丨CVPR 2026

西安交大与新加坡A*STAR团队提出论文《PaCo-RL: Advancing Reinforcement Learning for Consistent Image Generation with Pairwise Reward Modeling 》,将一致性问题转为“跨图比较”学习问题,结合强化学习实现能力闭环,提升多图生成一致性。

AI科技评论
新闻资讯8

刚刚,Claude独立攻克图论猜想,仅用31步!算法祖师爷高德纳震惊发文

Claude Opus 4.6仅用31步独立攻克图论猜想,算法祖师爷高德纳震惊发文,认为需重新评估生成式AI在数学研究中的作用。这标志着AI在自动推理和解决创造性问题上达到新里程碑。

新智元