「高并发系统」共找到 3436 篇相关文章
从静态模型到数字生命体:自进化AI Agent综述
近年大型语言模型催生AI智能体发展,但现有系统依赖人工预设,难适应动态环境。论文提出自进化AI智能体,可通过环境反馈自动优化,还提出三定律、四阶段范式演进模型等,开源EvoAgentX框架。
“憋屈” CEO出走GitHub!自曝在微软受限干不下去、被开发者骂蠢喊冤,或押宝Agent反攻老东家?
GitHub 首席执行官 Thomas Dohmke 宣布离职,之后将重新成为创始人。GitHub 将更全面融入微软组织架构,不再设单一领导者。Dohmke 任内升级 Copilot,但也面临功能被抱怨等问题,他还谈及 AI 发展方向。
GPT-5 在 Lovable/Vibecode 中氛围编码,附 GLM-4.5 对比 (反向搜索引擎、吵架的俄罗斯方块)
文章展示GPT - 5在网页端、Lovable、Vibecode的测试案例,与GLM - 4.5对比。如GPT - 5在WebDev Arena创纪录,不同版本使用限制不同。还列举多个应用案例,指出GPT - 5有不足,GLM4.5全栈开发表现不错。
实测GPT-5:写作坠入谷底,编程一骑绝尘。
文章记录了GPT - 5的发布情况,介绍其系统构成、减少事实幻觉和谄媚行为等改进,也提到跑分、性格设置等。实测发现写作和情商不如GPT - 4.5,但编程能力强,还感慨AI发展之快。
DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO
文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。
Agent KB:经验池让Agents互相学习!GAIA新开源SOTA,Pass@1性能最高提升6.66
来自多家机构团队发布 Agent KB 框架,构建经验池实现 AI Agent 经验共享。在 GAIA 基准测试中表现出色,提升多模型 Pass@1 性能,还在软件工程领域展现价值。其设计精妙,经消融、检索策略等实验验证有效。
无需验证器的RL:RLPR解锁LLM通用推理潜能
现有依赖强化学习与可验证奖励(RLVR)提升大语言模型(LLM)推理能力的方法,受限于领域特定验证器。本文提出RLPR框架,利用LLM生成正确答案的固有概率作奖励信号,实现无需外部验证器的通用领域强化学习,效果显著。
中山大学&华为联合提出 Issue Resolution 数据集构建神器SWE-Factory:每条只要$0.024
中山大学和华为联合提出低成本开源方案 SWE-Factory,可自动收集代码打造高质量代码评估数据集。它能解决传统构建流程繁琐、依赖人工的问题,实现全流程自动化,还构建了 SweSetupBench 数据集,表现出色。
首创Mid-training范式破解RL奥秘,Llama终于追平Qwen!
上海创智学院和上海交通大学研究团队深入探讨不同基础语言模型在强化学习训练中的差异,提出中期训练策略,将 Llama 改造成适配 RL 的推理基础模型,缩小与 Qwen 性能差距,还发布了 MegaMath-Web-Pro-Max 数据集。
如何实现RAG与MCP集成
文章聚焦RAG与MCP集成,介绍RAG突破传统模型局限及不足,引出Agentic RAG。阐述MCP革新AI工具连接方式,结合二者构建集成架构,还给出实现步骤、优化策略与代码实践,为释放AI系统潜力提供方案。