「推理方法」共找到 3292 篇相关文章
刚刚,Claude Fable 5续命5天!省钱攻略来了
7月7日凌晨,Anthropic官宣最强Claude Fable 5限时免费延长到7月12日。开发者给出自救方法,Anthropic也甩出顾问和编排者两套省钱架构,实现成本降低效果。
Anthropic顶级Claude模型被逆向开源,这几个模块借鉴了DeepSeek
22岁开发者逆向开源Anthropic的Claude Mythos Preview模型架构,名为OpenMythos。其核心模块借鉴DeepSeek,采用带混合专家路由机制的循环Transformer,有独特设计和稳定机制,重新框定扩展性争论。
东方理工团队提出HiDrop:重构MLLM计算路径,压缩90%视觉Token实现2.2倍加速
东方理工大学沈晓宇团队提出HiDrop,基于MLLM不同层功能差异,设计出延迟注入、凹金字塔式剪枝和提前退出的视觉Token压缩策略。实验显示,它能压缩约90%视觉Token,保持98.3%性能,实现训练和预填充加速。
Blender MCP功能使用与案例详解!
文章全面介绍3D创作工具Blender MCP,它基于MCP协议,可通过自然语言指令操控Blender。文中涵盖安装配置、核心功能及实战案例,还给出常见问题解决办法,显著降低创作门槛,提升创意转化效率。
一个月重写三次代码库、三个月就换套写法!吴恩达:AI创业拼的是速度,代码不重要
吴恩达在 Y Combinator 演讲分享创业心得,指出执行速度是创业成败关键,创业者最大机会在应用层,介绍提速方法,还回应 AGI 炒作、token 成本等问题。
从零开始200行python代码实现LLM
文章从传统思路实现诗词生成器入手,介绍了词汇表、Bigram模型等概念,接着用Python和PyTorch实现了真正的Bigram模型,阐述模型、训练等内容,最后回顾成果,下一篇将基于此实现完整GPT。
微软等提出「模型链」新范式,与Transformer性能相当,扩展性灵活性更好
随着大语言模型发展,扩展 Transformer 架构成趋势,但参数规模增长带来训练负担。微软等研究者提出 CoR 概念,构建模型链学习范式,应用于语言模型得 CoLM 系列,实验显示其性能相当且扩展性、灵活性更好。
2025年各大厂真实面试题,抓紧上车还有机会!!!
作者小华整理 2025 年字节跳动、腾讯、阿里大厂面试真题及题解,涵盖算法、数据库、分布式等多领域,还给出记忆方法,助找工作或刷题同学备考。
智能流体力学专题研讨会特邀报告1|潘翀:复杂流动智能测量方法——物理约束、数据同化与应用
2026年8月,第十四届全国流体力学学术会议在青岛举行。智能流体力学专题研讨会展示了AI与流体力学交叉研究进展。本次分享潘翀报告《复杂流动智能测量方法:物理约束、数据同化与应用》,含多种算法等内容。
重磅!Anthropic内部神秘模型在黎曼猜想上取得突破:关键下界从41.6%推到67.2%
A厂宣布Claude在黎曼猜想相关问题取得进展,其内部研究版Claude将黎曼ζ函数零点满足猜想比例的已知下界从41.6%提升到67.2%,经数学家验证,结果意外且有新方法。