「生成式引擎优化」共找到 3503 篇相关文章
单卡4090也能高质量视频编辑!西湖AGI Lab无训练框架FlowDirector来了
视频编辑门槛高、现有方法开销大且效果不佳。西湖大学AGI Lab团队提出无需训练的FlowDirector框架,可将基于流的视频生成模型改造成编辑工具,质量高、功能广、开销低,解决了时序、结构和编辑幅度问题。
面壁MiniCPM4端侧模型发布:长文本推理 5 倍提速,0.5B 模型拿下新SOTA
2025智源大会,面壁发布MiniCPM4.0端侧模型,含8B稀疏闪电版与0.5B款。其采用InfLLM架构,实现长文本推理5倍提速、最高220倍加速,还在性能、部署等方面优化,适配多芯片与框架。
1 分钟,我在百度 App上免费部署了OpenClaw
OpenClaw热度高,但原生部署折腾且成本高,应用少。百度App提供免费轻量部署入口,耗时不到一分钟;百度智能云0.01元可进阶部署。实测它在信息搜集和代码生成任务表现好,但也有局限。
模力工场 030 AI 应用榜:字节新品硬刚 Sora,“随变”登顶榜首
模力工场第 030 周 AI 应用榜揭晓,32 款应用上架,从社区声量高的应用中精选十款。涵盖创作、学习、智能自动化、心理疗愈等领域,上榜应用凸显 AI 从‘简单生成’向‘深度交互与高效执行’转变趋势。
Scaling Law 仍然成立,企业搜广推怎么做才能少踩“坑”?
InfoQ《极客有约》X AICon 直播邀请京东颜林等探讨生成式推荐落地洞察。指出搜广推场景 scaling law 成立且在上升,还分享大模型对搜广推的改变、架构成长方式,及平衡成本等方面的经验。
TileLang深入详解-第二章-TileLang 核心编程抽象
文章深入解析TileLang核心编程抽象,介绍写kernel的方式,阐述TileLang三层抽象特点及适用场景,展示JIT工作流、接口和执行后端,还提及性能优化、基准测试、正确性校验,最后用GEMM示例对比三层抽象差异并给出使用建议。
万字长文 | 异构算力技术架构与核心组件解析
文章聚焦异构算力技术架构与核心组件,解析主流AI芯片特点、国产芯片技术路线;介绍高速互联技术、网络拓扑结构及优化方法;阐述大模型存储需求、分布式存储技术及数据预处理与加载技术,为AI计算提供全面方案。
初探:从0开始的AI-Agent开发踩坑实录
作者分享从0开始开发AI Agent实现开源应用Helm Chart自动化生成的历程。介绍了定义角色、明确AI能力边界等开发要点,尝试三种Agent范式,还提及实践痛点如AI可观测性不足、Prompt工程困境等。
图解Vllm V1系列7:使用AsyncLLM做异步推理
文章因异步RL讨论热,探讨用vllm做最小程度异步二次开发。介绍如何用AsyncLLM做异步推理,分析单条请求处理流程及阶段,说明并发提升效率的方法,还提及多请求并发及构建异步推理引擎思路。
大模型下半场,阶跃凭什么领跑多模态之战
国内大模型竞争分资源派、技术派、国家队三阵营,多模态成竞争分水岭。阶跃星辰成立两年发22款自研基座模型,16款为多模态。其坚持理解生成一体化路线,在多模态领域有优势,还布局多应用场景。