「Code LLM」共找到 1848 篇相关文章
GLM4.5实测:审美不如R1,全栈还不大可用,别急冲
7月29日智谱开源GLM - 4.5。作者实测发现其在UI设计审美不如R1,生成卡片表现不一,Coding能力勉强及格,全栈代码生成未达可用阈值,存在无多模态能力、上下文窗口短等问题,目前还别急着冲。
NIPS2025 | A-Mem让Agent拥有动态自我记忆功能,达到新SoTA
近年来,LLM代理需长期内存系统,但现有系统缺乏灵活性。论文提出A - Mem能动内存系统,受Zettelkasten启发,能让记忆‘自我整理’和‘自我更新’,在多基准测试领先,也指出了局限性和未来方向。
我的AI OS搭建思路
作者黄益贺分享AI OS搭建思路。其系统以Claude Code为框架、Kimi K2 Thinking为模型,通过Skill和自定义命令满足工作需求,设计三层文件夹体系处理信息,供大家参考搭建。
苹果新研究:不微调、不重训,如何让AI提问效率暴增6.5倍?
苹果与牛津、港城大合作提出 BED - LLM 方法,能让 AI 解决问题能力提升 6.5 倍,无需微调重训。它基于序贯贝叶斯实验设计框架,通过三重智慧设计,经测试全面超越基准方法,或开启‘智慧对话’时代。
Karpathy最新分享!给大模型做好“服务”将是巨大机会
近日,Karpathy在AI Startup School演讲,提出AI正从根本改变软件。他将软件分三个时代,认为LLM是全新操作系统,还指出其特长与局限,点明AI时代两大机遇:部分自主应用和构建Agent友好工具。
仅用10天?Anthropic最新智能体Cowork的代码竟然都是Claude写的
Anthropic发布智能体工具Cowork,仅耗时一周半,其代码由Claude Code所写。它是Claude Code简化版,向特定用户开放,有多种功能。有用户称效率提升巨大,也引发创业圈震动,部分类似产品开源。
开源屠刀!400美元炼成「代码副脑」,硅谷天价模型成废铁
AI2开源Open Coding Agents,以最低数百美元算力成本,能训练贴合私有代码库的专属编程智能体。SERA-32B表现惊艳,其软验证生成技术降低成本,新代码易部署且兼容Claude Code。
14%论文都有AI代写?Nature:每7篇就有1篇藏有ChatGPT特征词
据Nature报道,研究发现在2024年PubMed上超20万篇生物医学研究摘要频繁出现LLM特征词。部分国家和学科中,AI辅助写作比例超五分之一且趋势上升,作者还会引导LLM规避痕迹。
AgentAuditor: 让智能体安全评估器的精确度达到人类水平
LLM智能体进化为“行动派”,但自主权带来安全问题。现有评估基准缺乏有效精准评估器,研究者推出AgentAuditor框架及ASSEBench基准,让LLM评估器精确度达人类水平,为构建可靠智能体提供工具。
云栖大会演讲实录:Qoder 产品背后的思考与未来发展
这是云栖大会上关于 Qoder 产品的演讲实录。Qoder 是阿里推出的 Agentic 编程平台,上线一月收获数十万用户。介绍了 AI Coding 三阶段,阐述 Qoder 定位、功能模式、技术优势,展望 AI Coding 未来。