「质量 - 延迟权衡」共找到 878 篇相关文章
苹果出手!改进GRPO,让dLLM也能高效强化学习
苹果研究团队针对扩散语言模型(dLLM)在编码任务中表现不明的问题,基于7B级代码生成MDM DiffuCoder展开研究,定制优化GRPO提出coupled - GRPO算法,填补开源dLLM训练和推理机制空白。
InfoQ 2025 年趋势报告:文化与方法
InfoQ 2025 年趋势报告指出,AI 虽提升开发速度,但带来质量问题,需新测试方法;团队协作重要,工程师依赖 AI 或破坏协作;初级工程师价值仍在,可借 AI 学习;可观测性成本攀升,应视为战略投资;平台工程是未来方向。
Spring 之父:我不是 Java 的“黑粉”,但我也不想再碰它!这门语言拯救了我......
Spring 之父 Rod Johnson 在播客中回忆 Spring 诞生,分享转用 Kotlin 的历程与感受。他认为开源要激发兴奋感,Kotlin 友好、易读,结合 Spring 近乎完美,还对其未来发展提出期望。
如何重现 DeepSeek 推理性能突破
DeepSeek-V3 是热门开源大模型,采用大规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。
Agentic AI 要终结数据库和 SaaS?大厂掌门人公开互撕,焦虑的 CEO 们押上了不同的技术路线
2025年Agent成AI热词,科技巨头与初创公司纷纷布局。微软和Salesforce掌门人公开“互呛”,代表两种不同落地路径。前者主张通用框架,后者强调垂直集成。当前二者Agent均有落地,但面临技术、成本等挑战。
InfoQ 2026 年趋势报告:AI 重写工程师角色,但一切仍然关乎人
InfoQ 2026 年趋势报告探讨了 AI 对软件开发的影响,包括重写工程师角色、团队演变等。嘉宾指出 AI 采用应结合风险和业务场景,巩固基础,重新设计审查流程,关注质量和人的因素。
3 天上了两个 SOTA 模型,视频 Agent 们接得过来吗?
7月31日MiniMax H3和字节跳动Seedance 2.5同日发布,3天后H3开源,8月7日Seedance 2.5开放api。模型变强使产品层要做的事更多,视频Agent需解决生产问题,竞争走向模型层之上。
拖更三年,北大校友翁荔最新长文刷屏!
前OpenAI副总裁Lilian Weng发布拖更三年的长文《Scaling Laws, Carefully》,指出AI行业依赖的Scaling Laws远比想象脆弱。OpenAI和DeepMind对算力分配结论相反,且Chinchilla方法论也有问题,同时数据快用完,经典公式前提在崩塌。
英伟达开源深度研究引擎:企业级数据不出门,研究自动做
NVIDIA推出AI-Q Blueprint,将深度研究流水线打包成Agent Skill,解决企业级数据处理难题。它能让企业数据不出门,代理框架可派任务并获报告,还支持多种认证模式,代码库可本地部署,专为深度研究打磨。
打破碎片化瓶颈!浙大&哈佛开源UniGeo,高保真相机可控编辑
当前主流相机可控图像编辑基于图像扩散模型,应对连续相机运动易出现问题。近日,浙大联合哈佛发布UniGeo框架,在三核心层面注入统一几何引导,克服结构退化,提升视觉质量与跨视角一致性。