「Code LLM」共找到 1849 篇相关文章
Thin Harness, Fat Skills:AI工程架构的本质
文章介绍了AI工程架构本质,阐述Garry Tan倡导的智能体工程三原则,分析架构分层,包括Fat Skills、Fat Code和Thin Harness层,还通过案例展示技能文件进化特性,提及社区讨论、边界迁移和工程纪律价值。
《动手写AI Agent》会话与记忆:记住上次聊到哪了
文章围绕《动手写AI Agent》的会话与记忆展开,指出LLM无状态、无会话持久化会让对话记录丢失。介绍了解决方案,如把对话存到磁盘及构建长期记忆,阐述设计决策并提到文件系统存储方案。
走一步看一步、两三个月就迷茫一次:字节扣子的两年「创业」
字节的扣子刚完成大版本更新,定位“职场AI,就用扣子”。它过去两年像早期创业团队“野生”生长,从Bot Studio到工作流平台,再到扣子空间,如今迈向Vibe Coding,强化“伙伴”定位,值得产品创新者研究。
提速79%!上交大新方法优化企业级AI流程调度 | IEEE ICDCS’ 25
上海交通大学朱怡飞教授团队联合江行智能提出调度框架LLMSched,解决复合LLM应用任务运行时长和结构不确定问题。该框架重构DAG模型,用贝叶斯网络和熵减机制优化调度,实验显示最多降79%平均任务完成时间。
DeepSeek低价风暴打服硅谷!海外平台争相倒贴V4 Flash
DeepSeek V4 Flash掀起价格风暴,全球开发者为之疯狂。海外平台如Nous Portal、Cline等纷纷补贴,其能力大幅提升,价格却极低,让开发者更愿尝试开源模型,AI应用层或迎转机,且DeepSeek Code可能将至。
5.1K Star!Codebuff 把整个 AI 编程团队装进你的终端!
Codebuff是开源AI编程助手,获超5.1k stars。其多智能体架构让不同智能体分工协作,理解代码上下文更好、编辑更准。官方测试中完成率61%,超Claude Code。它免费且上手简单,还能创建自定义智能体。
号称1200万token上下文的模型来了,数据亮眼但疑点重重
当地时间5月5日,Subquadratic公司推出模型SubQ,称是LLM智能重大突破,有1200万token上下文。数据亮眼,如在1M token场景比FlashAttention快52倍等,但也引发质疑,有人推测是对开源模型微调,官方未公布详细模型卡。
Karpathy实测Opus 5:读一段《魔戒》,10美元直出中土世界!
Andrej Karpathy 用 Opus 5 结合《指环王》开篇文字,花约 10 美元让其渲染 3D 游戏。Opus 5 两小时写出 5500 行代码生成 3D 世界,虽粗糙但证明 AI 强大。不过,LLM 无法高效审查自己工作,这是弱点。
想玩Loop Engineering,可以先从这6个Hook玩法开始。
Loop Engineering正火,入手可从Hook玩法开始。Hook是循环触发器,在Agent里很常见。文中整理了6个Claude Code的Hook玩法,如权限弹窗提醒、开机日程播报等,还提醒接入工作流要注意稳定性和边界。
糟糕,Claude Opus 4.7源代码级提示词曝光!底层设计全被看光
Claude Opus 4.7如期而至,性能全方位提升,编程暴打Gemini 3 Pro、GPT - 5.1。Claude Code之父分享最佳实践,还曝光系统级提示词,揭示其进化逻辑,此外还提及Mythos的一些危险操作。