后训练方案」共找到 4421 篇相关文章

开源动态8

阶跃开源JetSpec,大模型推测解码提速近10倍

随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。

AIGC开放社区
推荐文章8

API7.ai创始人温铭:烧了几百亿Token,我用AI重写了生产级网关,总结出6条经验

API7.ai创始人温铭分享用AI重写生产级网关经验。他认为AI编码能力超资深工程师,瓶颈在人。还介绍在公司‘禁手写代码’的情况,以及AI代码审查、使用阶段等内容,最说明重写AI网关AISIX的原因。

InfoQ
新闻资讯7

世界模型混战,Momenta率先冲刺IPO

当下世界模型是AI领域热门且混乱的概念,主流路线有四类。Momenta的R7世界模型已量产,其CEO定位公司为物理AI基座模型构建者。Momenta率先冲刺IPO,商业模式正转型,为续玩家提供价值评估体系。

量子位
新闻资讯7

30万AI顾问进公司,OpenAI砸1.5亿改写你的报销周报

6月14日,OpenAI掏出1.5亿美元推出Partner Network计划,要在2026年底前训练并认证30万名顾问,将AI塞进企业工作流程。此前Anthropic也有类似动作,模型竞争正转向落地应用。

新智元
新闻资讯8

银河通用王鹤:具身智能正迎来自己的 「AlphaGo」 和 「ChatGPT」时刻

银河通用创始人王鹤在2026年北京智源大会指出,具身智能正迎来“AlphaGo”和“ChatGPT”时刻。银河通用取得多项首创突破,其基座大模型“银河星脑”展示完整技术脉络,引领具身智能迈向通用未来。

AI科技评论
新闻资讯8

从Foundation Model到Physical AI,三星「杀入」大模型核心战场

三星正快速进入大模型核心战场,构建Foundation Model体系,采购GPU用于AI基建。它提出Meki架构、M2RL训练范式和LiveClawBench评测体系,由AI Model TF团队推进,负责人是唐业辉。

机器之心
产品应用7

用 Codex 拯救我的 Mac

作者从2008年开始用Mac办公研发,历经系统更迭未重装。现因系统更新,不少程序是Intel版,用Rosetta 2转接,很混乱。介绍用Codex清理开发环境、更换M芯片版本Homebrew的方法。

MacTalk
算法论文8

公里级场景也能稳住了,国产团队把长视频3D重建又往前推了一步

浙江大学、地平线机器人和之江实验室的新工作 Scal3R 要解决长视频 3D 重建问题。它借助 test - time training 技术,设计全局上下文模块和同步机制,提升长序列重建稳定性和精度,能处理超万帧几千米的场景。

机器之心
新闻资讯8

Claude彻底起飞!狂揽亚马逊5GW算力+250亿刀,贝索斯赚麻了

4月20日,Anthropic与亚马逊签署超级大规模AI基础设施协议,1000亿美元十年砸向AWS算力,锁定5吉瓦用于训练和部署Claude。亚马逊追加投资,Anthropic营收猛增,此合作揭示AI竞争转向基础设施。

新智元
开源动态8

刚刚,DeepSeek多模态技术范式公布,以视觉原语思考

DeepSeek发布多模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决多模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在多任务上超主流模型。

机器之心