「编程测试」共找到 2638 篇相关文章
长上下文不再难:KV Cache 全生命周期优化实战
长上下文大语言模型发展带来计算和内存挑战,现有基准测试多忽视 KV 缓存完整生命周期。微软姜慧强在 AICon2025 分享 SCBench 工具,梳理推理优化方法,介绍 MInference 等,还提出 Tri - shape 方法等成果。
双“雷”暴击!Trae 被曝资源黑洞、Claude背刺超级付费党,开发者们被“刀”惨了
AI编程应用大热,但运行卡顿、资源消耗惊人等问题随之而来。Trae被曝过度消耗资源,Anthropic宣布Claude Code对付费用户增加调用限制,反映出AI产品资源问题影响厂商和用户。
超过GPT-image-1!大黑马Black Forest刚开源新模型,只用文本实现一键PS
今日凌晨,Black Forest开源文生图模型FLUX.1-Kontext开发者版本,功能类似PS,用自然语言就能一键P图。测试显示它超GPT-image-1,成最强开源文生图模型之一,还在架构、训练、工程层面做了优化。
AI大模型浪潮下的认知重构:从一个数据老兵的转型思考
作者作为数据老兵,分享接触 ChatGPT 后的转型思考。指出 AI 使编程、数据分析师岗位巨变,填鸭式教育不再适用。强调认知结构是护城河,还探讨了 ETL、数据建模及 AI 原生产品变化。
“看懂”指令并做动作!Motion-R1结合COT让角色动起来
大语言模型为文本驱动动作生成带来新可能,但现有方法有局限。GigaAI提出Motion - R1框架,融合“思维链”机制,能分解指令、优化动作合成,虽有不足,但在测试中表现优于主流方法。
一文解读 LLM Posting-Train技术
文章解读了大语言模型后训练(Post-training)技术,介绍其核心价值,从微调、强化学习、测试时拓展三方面展开,分析现有技术瓶颈,指出前沿研究方向,还给出实践指南和工具链推荐。
黄仁勋最新访谈:我们已经实现了 AGI,领导力、心理学、生命、意识、死亡和人性
黄仁勋在 Lex Fridman 播客深度对话中,谈及 CUDA 决策、管理模式、四层 Scaling Law 等多话题。认为已实现 AGI,编程定义改变,程序员会增多,还分享对供应链、开源等看法。
昔日王者应用商店,将死!OpenClaw或杀死80%手机应用
OpenClaw创始人Peter Steinberger在访谈中称手机里80%的APP已死。OpenClaw能操控设备、完成复杂操作,还让非技术人会编程。不过它有安全风险,仍被部分人看好用于企业经营。
Clawdbot首破10万星,火箭式登顶GitHub!硅谷现象级爆款太火了
Moltbot(原Clawdbot)在GitHub星标数首破10万,成全球增速最快开源项目之一,超越Linux内核。它应用场景丰富,但也有风险,如致投资血本无归、AI建宗教。其开发者分享了编程感悟。
视频模型假装在推理?MME-CoF新基准评估12个推理维度
视频生成模型如Veo - 3能生成逼真视频,但推理能力存疑。香港中文大学等校研究者设计12项测试,发现模型只能模仿表面模式,未真正理解因果。研究推出MME - CoF基准,为评估指明方向。