「并发调度」共找到 212 篇相关文章
浙大校友打造AI代码测试神器,零代码零bug,30分钟创建网站
浙大校友打造的智能测试平台TestSprite 2.0,零代码零bug,30分钟创建网站,能让AI写代码准确率从42%跃升至93%,还可自动生成测试报告、调试修复错误,全程无需人工干预。
昇腾910B大模型实测:开源框架能不能打?真相全放这了
文章对昇腾 910B 大模型进行实测,对比 vLLM Ascend 与 MindIE 在实际推理场景中的性能差异。通过 GPUStack 平台测试多种模型,结果显示两者在不同部署场景各有优势,vLLM 适合单卡小模型,MindIE 适合大模型多卡部署。
在校生开发,榨干 win 系统全部带宽!
介绍在校生开发的开源工具 HypoMux,它面向 Windows,能把多张网卡「绑」在一起,让下载任务多线路并行。有双模式可选,还能智能分流,兼容主流加速器。操作简便,可解决下载慢问题。
告别多奖励跷跷板:Flow-OPD将多教师OPD带入图像生成
中国科学技术大学等机构团队提出Flow - OPD,这是首个将OPD引入流匹配模型的统一多任务后训练框架。它解决了流匹配模型后训练对齐中多任务的梯度冲突等问题,效果良好,未来有多个拓展方向。
晶圆级芯片和存算一体结合:中科院提出15万tokens/s晶圆级芯片方案丨ASPLOS'26
当前大模型发展对计算硬件需求增长,数据搬运成隐性开销。中科院团队成果Ouroboros实现晶圆级芯片,解决数据搬运问题,虽面临挑战,但性能与能效表现显著,验证了“存算一体+晶圆级集成”路线可行性。
自动驾驶优化:从复杂性到实时工程
本文深入探讨自动驾驶技术栈端到端架构,阐释从上下文感知传感器融合到MPC求解器等优化技术,如何将原始传感器数据转化为安全控制指令,还介绍轨迹规划、实时计算预算及调试等内容。
24K+ star!AI 专用无头浏览器,快11倍、内存省9倍!
Lightpanda是专为AI代理、网页抓取和自动化测试而生的开源无头浏览器,用Zig语言重写核心引擎。官方称其速度比Chrome快11倍,内存占用仅为1/9,兼容主流自动化库,目前处于Beta阶段,已获24k+ Star。
OpenClaw 火了半年,Agent 执行层依然是工程空白
当前主流 Agent 工具链执行层基本空白,Violoop 是少数在执行层做系统化设计的项目。它是桌边触屏硬件,获取三类运行时数据,具备感知 - 判断 - 执行运行时,有多种核心能力,适合特定场景团队评估。
别跟风买Mac Mini了!国产算力跑OpenClaw,只需5分钟
最近,Clawdbot爆火,OpenClaw仓库Stars涨至13万,但运行它消耗大,很多人用Ollama拉取本地模型。不过,Ollama只支持部分生态,国产芯片用户面临挑战。2026年2月2日开源的玄武CLI可解此难题。
苹果光速撤回RLAX论文:用了谷歌TPU和阿里Qwen,作者中还有庞若鸣
苹果一篇新论文在 arXiv 公开后匆匆撤稿。该论文揭示基于 TPU 的可扩展 RL 框架 RLAX,用了谷歌 TPU、亚马逊云及阿里 Qwen 模型,还介绍其架构、策略支持等,实验结果亮眼,也分享 Debug 过程。