代码实验」共找到 2808 篇相关文章

算法论文8

System 3 觉醒:从“工具”到“物种”的根本改变

西湖大学与上海交大新论文提出System 3概念及Sophia框架,将认知心理学概念映射到代码模块,让AI Agent像“生命体”生存。采用前向学习和混合奖励机制,实验显示其能力显著进化,为人工生命指明道路。

深度学习自然语言处理
推荐文章8

LlamaIndex 深度实战:用《长安的荔枝》学会构建智能问答系统

文章兼顾 RAG 科普与 LlamaIndex 实战。介绍 RAG 原理,用《长安的荔枝》讲解关键步骤和参数。实战部分展示用 LlamaIndex 搭建问答系统,代码量少。优化篇通过实验给出参数调优建议,架构篇剖析内部机制,最后提及 Agent 化拓展功能。

阿里云开发者
推荐文章7

从 Langchain 到 Spring AI,我们究竟需要怎么样一个企业级 AI 开发基础设施?

文章指出AI Agent应用开发方式演变快,企业构建AI Agent体系面临挑战。介绍了AI Agent应用架构变化及趋势,如AI应用平台低代码效应、框架与平台双轨并行等,还总结了四类AI Agent框架及企业级框架平台核心考量。

phodal
8

刚刚!Kimi Linear横空出世,全新注意力架构:1M长文本解码速度飙升6.3倍,KV缓存砍掉75%

月之暗面推出全新注意力架构Kimi Linear,有望成下一代Agent LLM基石技术。它解决了LLMs处理长序列任务的瓶颈,性能超传统机制,还开源了核心代码。Kimi Linear的KDA模块提升了表达和硬件效率,实验表现佳。

AI寒武纪
算法论文8

Qwen3-VL-Seg 深度解读:当多模态大模型学会"像素级精准手术",仅用0.4%参数碾压8B模型

文章深度解读阿里通义实验室发布的Qwen3-VL-Seg,它解决开放世界指代分割问题,用仅17M参数(占基础模型0.4%)在4B规模超越8B模型。介绍其原理、架构、数据、实验结果,还给出实战代码

机器学习AI算法工程
算法论文8

Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃

大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。

深度学习自然语言处理
产品应用7

Codex在推理框架上能蹬出什么优化

作者复盘用Codex在SGLang中的实践,原本需3 - 4个月的工作量现缩短为1个半月。介绍保证代码质量方法,分享印象深刻的debug经历,列举在SGLang用Codex一个月的优化成果,还提及Claude Code使用遇阻。

GiantPandaLLM
推荐文章7

马斯克的好兄弟,卡帕西又双叒出新指南!GPT-5 Pro是AI编程最后防线

在「代码后稀缺时代」,Karpathy分享AI辅助编程体会。他认为不同工具各有优劣,Cursor适合日常开发,Claude Code与Codex能完成大块功能但缺「品味」,GPT - 5 Pro是攻克顽固bug的最后防线。

新智元
开源动态7

33.5k星星爆火!这个开源插件让AI不再写屎山,token自然就省下来了

Ponytail是开源插件,将资深工程师工程直觉整理成skill规则,供Claude Code等AI coding agent加载。它让AI开发更克制,减少代码量、成本,提升速度,核心是强制AI做复杂度判断。

开源AI项目落地
产品应用7

比 Context7 更靠谱:Exa-code 靠 1B+ GitHub 与 Stack Overflow 减少幻觉

Exa团队索引超1B+文档、GitHub仓库等内容,exa - code对其混合搜索、分块处理。它是首个为编码代理制作的Web规模上下文工具,在代码幻觉评估中表现超流行网页搜索工具,核心技术有专为AI的搜索引擎和高效返回上下文。

AI进修生