「编程环境」共找到 1515 篇相关文章
混元开源PhoneBuddy-4B与5篇系列论文:多项手机Agent真机评测超过GPT-5.4
腾讯混元Phone - use Agent团队发布PhoneBuddy - 4B及5篇系列论文。研究探讨如何训练真实可用的Phone - use Agent,采用Real + Mock方式,实验显示该方法提升效果显著,4B模型多项任务超GPT - 5.4。
7,700+ star 微软 SkillOpt 可以训练的Skill
微软研究院开源了SkillOpt(7700+ star),把Skill文档当成‘可训练的权重’来优化。它有独特的6阶段流水线、核心验证门控、Protected Regions机制,还有SkillOpt - Sleep预览功能,让Skill文档可系统化训练。
Anthropic 调整 Claude 额度;黄仁勋最后登访华机;GPT-5.6加速来袭;李彦宏提出AI新指标DAA
2026年5月14日AI资讯日报涵盖多领域动态。新闻有Meta田渊栋创业、黄仁勋访华等;产品应用涉及Hermes Agent、百度秒哒3.0等;推荐文章含腾讯程序员构建执行环境等观点。
The Batch: 954 | Kimi K2.6 挑战开源权重模型领先者
Moonshot AI升级后的Kimi K2.6是1万亿参数的视觉 - 语言模型,专为代码生成设计,性能与Qwen3.6 Max Preview等相当,略逊顶级闭源模型。其功能多,幻觉率低,模型权重可免费下载。
一个只有70行的文件,凭什么拿下GitHub 10万星?
GitHub上‘andrej - karpathy - skills’项目爆火,核心是不到70行的CLAUDE.md文件,给出AI编程助手行为准则。其火的原因有解决痛点、名人背书等,价值在于证明‘上下文工程’重要。
单Agent时代正式结束:一个干不过,就上300个
月之暗面发布并开源 Kimi K2.6 模型,热度高。它强化 Agent 团队协作能力,核心能力进步,领先对手。在编程领域发力,长程编码能力突破,集群协同输出强,还适配框架,实测效果出色,Claw 群组开启内测。
存量代码库难适配、人机边界模糊?百度拆解Coding Agent企业级落地的硬核解法
本文基于百度资深研发工程师颜志杰在2025 AICon大会演讲整理,剖析Coding Agent企业级落地三大挑战,分享百度“知识体系 + Rules建设”等实践,揭示开发者构建工程配套跨越代际鸿沟的方法。
谷歌开源 Colab MCP Server,AI 智能体可云端运行代码
谷歌开源 Colab MCP Server,使 AI 智能体通过 MCP 与谷歌 Colab 交互,将本地智能体工作流与云端执行环境打通,解决本地部署局限,还反映 AI 智能体与外部工具交互标准化趋势。
OpenClaw大考!上海AI Lab InternLM团队WildClawBench 60题,把「龙虾」AI打回原形
上海人工智能实验室InternLM团队推出WildClawBench,含60道高难度任务,在真实OpenClaw环境端到端评测AI Agent。评测涵盖多类别任务,已测14个模型,国产模型表现亮眼,项目开源可复现。
换掉小龙虾!Hermes全网爆火狂揽四万星,Anthropic重锤暴击OpenClaw
近期两大AI新物种冲击OpenClaw。Anthropic上线的Managed Agents实现大脑与执行环境分离,有降维打击效果;Hermes Agent开源且在GitHub揽4万星,有学习闭环,让OpenClaw显得过时。