推理流程」共找到 2758 篇相关文章

算法论文7

谷歌TurboQuant会绕过“内存墙”?这个判断有点过了|甲子光年

谷歌发布的TurboQuant论文引发市场震动,其算法可将大语言模型推理的KV缓存大幅压缩并加速。但将其视为绕过‘内存墙’判断过度,它提升单位字节信息密度,改变边际需求曲线,代表范式转移。

甲子光年
新闻资讯7

SpaceX为何官宣收购xAI?8万亿太空炼丹梦,别无脑跟进!

2026 年 2 月 3 日,马斯克宣布 SpaceX 全资收购 xAI。直接原因是 SpaceX 盈利而 xAI 烧钱,合并为解决资金问题;根本原因是 Grok 竞争失利,想借 SpaceX 运载能力打造太空算力形成差异。但太空训练面临散热等难题,推理可行。

新智元
产品应用7

SpecKit 在成熟 Java 项目中的 AI 编码实践

文章分享SpecKit在成熟Java项目的AI编码实践,引入其作为规范管理工具,按标准化流程操作。介绍选型、环境准备、执行步骤,分析优缺点,还提及Qwen - Image解决AI绘画文字问题。

阿里云开发者
开源动态8

刚刚,Andrej Karpathy放出大招:开源nanochat项目,仅8000行代码100美元就能训练出一个ChatGPT

Andrej Karpathy发布nanochat项目,用8000行代码实现ChatGPT完整训练流程。在8xH100节点跑4小时、花100美元,就能有对话、写故事、答题的AI助手。项目覆盖广,含多训练步骤及评估体系。

AGI Hunt
新闻资讯7

Anthropic发布Agent SDK,截胡 OpenAI

OpenAI Agent Builder消息传开,大家等其Dev Day发布时,Anthropic突然宣布将Claude Code SDK改名Claude Agent SDK,抢先发布完整智能体开发框架。该SDK有独特理念、工作流程及多种功能,与OpenAI产品理念不同。

AI工程化
新闻资讯7

刚刚,大模型棋王诞生!40轮血战,OpenAI o3豪夺第一,人类大师地位不保?

国际象棋积分赛成果出炉,OpenAI o3以人类等效Elo 1685分夺冠,Grok 4和Gemini 2.5 Pro紧随其后。Kaggle发布国际象棋文本排行榜,评估模型战略推理等能力,还推出相关数据集,虽有局限但意义重大。

新智元
新闻资讯7

AI 的宿命数字

AI在1到50间随机选数时,常选27,还编造推理过程,会根据时间调整算法保证结果为27,也有选42等情况。这或源于人类文化偏见,AI是人类集体记忆镜子,难摆脱宿命。

AGI Hunt
开源动态8

MetaShuffling:Meta的Fused MoE kernel工程方案,更激进的Kernel优化和尽量避免Padding

文章介绍Meta的Fused MoE kernel工程方案MetaShuffling,可高效部署Llama 4模型。它处理MoE推理挑战,介绍多种token选择路由方案,阐述运行时设计、不同并行化方式及优化思路,还展示性能测试与Trace分析。

GiantPandaLLM
算法论文8

瘦身不降智!大模型训推效率提升30%,京东大模型开发计算研究登Nature旗下期刊

京东探索研究院大模型研究登Nature旗下期刊。其提出系统与方法,经四大创新使大模型推理提效30%、训练成本降70%。成果支撑JoyBuild平台,可帮企业将通用模型转化为专业模型,加速商业化落地。

量子位
产品应用7

Cursor 3 发布:IDE 不重要了,智能体控制台上位,VS Code 这一套开始失效

Cursor 3 发布,用智能体管理控制台取代传统代码编辑器,标志 AI 辅助开发工具与开发者工作流程重大转变。它带来多仓库支持、Cloud Handoff 等功能,转型源于竞争压力,业界对智能体编排层架构设计未达成共识。

InfoQ