开源边界」共找到 3231 篇相关文章

开源动态7

DeepSeek|从零构建轻量级vLLM:Nano-vLLM,吞吐量逼近原版,代码仅需1200行

开源的vLLM能提升LLM推理速度和资源利用率。近日,DeepSeek AI俞星凯从零构建轻量级Nano - vLLM,代码仅1200行。它有离线推理等功能,基准测试显示吞吐量逼近原版。

AINLPer
算法论文8

知识类型视角切入,全面评测图像编辑模型推理能力:所有模型在「程序性推理」方面表现不佳

东南大学等团队提出KRIS - Bench,从知识类型视角对图像编辑模型推理能力评测。它分三大知识范畴、细化多种任务,设四维度评估指标,测10款模型,发现模型程序性推理等能力不足。

量子位
开源动态8

MetaShuffling:Meta的Fused MoE kernel工程方案,更激进的Kernel优化和尽量避免Padding

文章介绍Meta的Fused MoE kernel工程方案MetaShuffling,可高效部署Llama 4模型。它处理MoE推理挑战,介绍多种token选择路由方案,阐述运行时设计、不同并行化方式及优化思路,还展示性能测试与Trace分析。

GiantPandaLLM
产品应用8

对普通人最有用的一次!藏师傅教你用FLUX Kontext解决一切图片问题

黑森林工作室发布生成式流匹配模型 FLUX Kontext,它能编辑图片且不影响未编辑区域,支持多图参考生成新图像。可用于去水印、修复照片、修改海报、生成商品展示图等,还能美颜美体,替代 PS 等工具。

歸藏的AI工具箱
开源动态8

全球首次实测通过!CMU华人用AI设计的乐高「不翻车」

CMU研究人员提出LegoGPT,它微调Meta的LLaMA模型,结合47000个稳定结构数据集,确保98.8%的乐高设计符合物理定律,可实际搭建。目前,数据集、代码和模型均已开源

新智元
新闻资讯7

一个跑智能体,一个专门找漏洞:Google发布Gemini 3.8双版本

9月2日,Google发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。前者用于编程等,已稳定上线;后者专用于发现修复漏洞,仅向特定方开放。二者共享基础能力,采用不同安全限制和部署环境。

AIGC开放社区
新闻资讯7

每周产业洞察|校园母题与流量要素成为AI短剧行业的爆款公式

近期AI短剧行业数据亮眼,TikTok生态和国内市场规模惊人,但淘汰率也高。其有“校园母题+流量要素”爆款公式,AI降低制作成本,工具平台参与度加深,且用户画像向男性、游戏用户迁移。

郎园Station
开源动态7

教你构建私有 AI Coding 平台:Pi、DSH、Codex Harness 扩展能力对比与选型。

文章聚焦构建私有AI Coding平台,对比Pi、DeepSeek Harness、Codex Harness的架构、扩展能力及选型策略。介绍三者交互集成方式,分析其扩展特点,并为不同需求团队给出选择建议。

AI大模型应用实践
算法论文8

提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026

香港科技大学研究发现,大模型的“提示词压缩”模块会重写系统安全边界,成为新攻击面。团队提出“对抗性信息损失”概念和COMA攻击框架,实验有效,还给出隔离压缩防御方案。

机器之心
产品应用8

OceanBase湖库一体,重新定义AI数据库

AI时代数据库面临变革,使用者从人类应用扩展到Agent,管理的数据和承载的工作负载也发生变化。OceanBase坚持一体化设计,发布湖库一体的AI数据库,解决AI生产系统的数据基础设施问题。

量子位