「软件开发生命周期」共找到 1999 篇相关文章
0%完成率!Claude、GPT、Gemini 全灭,SWE-Bench作者新作把AI圈干沉默了
SWE - Bench创建者推出新benchmark ProgramBench,测试AI从零构建软件系统能力。结果一线模型完成率0%,暴露AI擅长局部代码生成,缺全局系统规划能力,引发对其评估方式的讨论。
AI4S设计的新抗生素通过湿实验!双层思考+多目标优化,主动发现「代谢不稳」并加约束
SAGA是新AI,采用双层思考机制,能主动审视需求、优化目标函数。在抗生素、纳米抗体等5大领域湿实验中表现出色,结果获科学家肯定,相关代码已开源。
Claude Code 终端工具链完全指南:7 款终端横评 + 我的最佳实践
文章对 7 款主流终端进行横评,给出 Shell 配置、终端复用器、快捷键的最佳实践,旨在让 Claude Code 体验更顺滑。介绍各终端特点、适用场景,避坑 Powerlevel10k,推荐 Starship,强调 tmux 重要性,还给出常见问题解决方案。
9k星星!知名特效团队开源「完美AI绿幕抠像工具」,8G显存的老Mac都能跑
知名特效团队Corridor Digital开源抠像软件CorridorKey,只需8G显存,N卡和Mac都能跑。它针对复杂边缘和色彩溢出问题提供解决方案,能精准捕捉发丝级细节,功能强大。
微信龙虾只活2天:一次更新干崩全生态,OpenClaw 撞上 Vibe Coding 天花板
3月22日微信官宣推出支持接入OpenClaw的ClawBot插件,两天后OpenClaw更新,将插件生态系统迁移到官方ClawHub市场,引发诸多问题,如系统崩溃、插件失效等。此次事故暴露系统脆弱性,也为Vibe Coding发展敲响警钟。
春晚武BOT论文来了!王兴兴署名,同步开源其架构
宇树发布武BOT技术论文,王兴兴署名,同步开源OmniXtreme架构。该架构通过双阶段框架,打破学习和物理可执行性瓶颈,在高保真度与可扩展性间权衡,经测试在真实硬件上表现出色。
Agentic 软件工程:造 Agent 只是最简单的部分
Agno 创始人 Ashpreet Bedi 认为造 Agent 简单,让其在生产环境稳定运行才是挑战。他提出 Agentic 软件六大支柱,给出 AgentOS Docker 模板代码实践,指出多数 Agent 产品卡壳是基础设施跟不上。
1.2万人收藏单日斩获 3.4K!刚刚冲上 GitHub Trending 榜首的“AI 红队”工具!
AI加速代码编写,但也留下更多安全坑,传统扫描工具和人工渗透测试难以应对。新晋GitHub Trending榜首工具Shannon是全球首个开源全自动AI渗透测试员,多智能体架构,功能强大,适合AI编程团队。
配置一改就要重启的时代结束了:Dev Proxy 2.1 正式上线
Dev Proxy团队发布2.1版本,围绕开发效率和本地测试体验更新,有配置热重载、stdio流量代理等新功能,还改进配置、性能及细节问题。Dev Proxy Toolkit 1.12同步发布。
评论送书 | Al智能体与传统AI应用的区别?它如何工作?如何快速构建智能体?
文章对比AI智能体与传统AI应用,指出前者更像“乐高积木”,可融入生活工作。介绍其工作是“感知—推理—执行—学习”循环,还给出快速构建通用方法,如明确目标、选框架等。