「软件构建」共找到 2420 篇相关文章
HarnessEval 来了!开启 RSI 时代的新评测范式!
过去一年AI进入RSI时代,但评测方式仍停留在过去。MirroS联合多方发布HarnessEval,将Harness引入评测领域,使评测成为具备自我进化能力的智能系统,还率先应用于交互式世界模型评测。
模型不是企业的护城河,那什么才是?
文章指出企业AI进入深水区后,真正的竞争是将AI变成企业自己的智能引擎。衔远科技创始人周伯文提出泛化基础上的深度专业化是企业竞争力来源。衔远发布EnterpriseClawBench,揭示企业需私有化评估和可持续进化能力。
8.8k星星!开源的211个专家级Agent,一键接入,一个人就是一个团队
今天推荐agency-agents-zh库,它是agency-agents深度汉化版,有211个精选Agent,适配国内生态。需注意,skill并非越多越好,按需选择,避免浪费资源和输出无效结果。
19.2K Star!Linux上无缝运行Win应用,超酷~
在Linux系统下运行Windows应用一直是难题,开源项目WinBoat能让Linux用户无缝运行Windows应用,通过容器和远程桌面技术,将Windows应用变Linux原生窗口,还具备自动化部署等多样功能。
跳过88%专家,保住97%性能!MoE推理的正确玩法| CVPR’26
多模态大模型走向大规模,MoE架构虽降低计算开销,但推理成本仍高。香港科技大学等团队提出MoDES,它是training - free动态专家跳过框架,能跳过88%专家还保留97%性能,推理速度提升2倍。
让扩散模型「可解释」不再降质,开启图片编辑新思路
过去三年扩散模型席卷图像生成领域,但可解释性研究是‘黑箱’,且现有尝试常致性能下降。香港中文大学与上海人工智能实验室团队提出TIDE框架,可解释且不降质,还带来新图像编辑方式。
金山、Zilliz、腾讯、灵犀量子专家齐聚,揭秘 AI 记忆、RAG 演进与自我进化的工程实践 | AICon
2025 年构建复杂 AI 系统面临记忆缺失、检索瓶颈、认知固化等系统工程挑战,Context Engineering 是关键。AICon 北京站邀金山、Zilliz、腾讯、灵犀量子专家,分享上下文工程技术实践。
PyTorch 基金会迎来 Ray 项目,并推出 Monarch 简化分布式 AI 开发
2025 年 PyTorch 大会上,PyTorch 基金会宣布 Ray 项目加入,还推出 PyTorch Monarch 简化分布式 AI 工作负载。大会突显基础模型开发对透明度和可复现性的推动,基金会欲成开放式 AI 基础设施核心枢纽。
Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro
Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。
Nature子刊 Scientific Data | 九家单位联合打造!AeroFlowData
现有湍流数据库多聚焦中低雷诺数基础湍流问题,难应对复杂工程高雷诺数湍流挑战。西北工业大学联合八家机构建全球共享的高雷诺数湍流数据库AeroFlowData,结合多技术获取数据,收录近40类模型、超500种工况,数据近100TB。