「Qwen2.5-3B-Instruct」共找到 3473 篇相关文章
Qwen-Image-Edit 更新:多图编辑支持,单图一致性增强
阿里8月发布的Qwen-Image-Edit迎来月迭代版本Qwen-Image-Edit-2509,可在https://chat.qwen.ai/使用。更新支持多图编辑,有多种玩法,还提升单图一致性,在人物、商品、文字编辑上表现显著。
LightX2V fp4 quant kernel代码笔记
这是关于 LightX2V 里 `lightx2v_kernel` 做 FP4 量化 GEMM 的读码笔记,解释接口和约束、kernel 关键路径等问题,还介绍 NVFP4 和 MX-Formats 量化原理、代码实现,以及 LightX2V 项目中的实际使用。
Kimi K2里找到了DeepSeek V3架构
Kimi新模型K2热度高,在多benchmark上达SOTA,网友好评多。Kimi工程师透露K2开源原因,还谈及Kimi发展策略。实测显示K2在前端制作、工具调用、创意写作上表现出色。此外,OpenAI开源模型推迟,引发猜测。
Qwen3-Next:迈向更极致的训练推理性价比
文章发布Qwen3-Next架构及Qwen3-Next-80B-A3B系列模型,通过混合注意力等改进提升训练推理效率。介绍模型结构、性能优势,还说明使用方法,包括在多平台部署及处理超长上下文,展望持续优化架构。
凌晨战神Qwen又搞事情!新模型让图像编辑“哪里不对改哪里”
Qwen团队发布Qwen-Image-Edit,作为Qwen-Image20B图像编辑版,能精准修改文字,还可新增、消除、重绘、修改元素,支持IP编辑、视角切换等玩法,在多方面表现出色。
jina-embeddings-v5-omni 发布!全模态向量小模型
Jina AI发布`jina-embeddings-v5-omni`,将`v5-text`能力拓展到多模态。`v5-omni-small`参数量小却追平LCO - 7B,在多模态评测中表现优异,但视频是短板。其采用‘冻结 + 投影’架构,训练快、省显存。
Qwen3.8-Flash:全新架构,更强更稳更划算
本文介绍了 Qwen3.8-Flash 多模态 MoE 模型,它原生支持 262,144 token 上下文。该模型在 Attention、Residual、Embedding 与 Optimization 四个方面系统升级,降低训练与推理成本,即将上线千问 AI 平台。还发布了 Qwen3.8-Flash-Next 开源权重。
V2G的羊毛不好薅|甲子光年
国家出台政策推动V2G发展,有人认为新能源车主卖电赚钱的春天来了。但实际上V2G商业化落地存在工程难题,虽政策推动使其热度回升,多项目绕开并网采用“表后”应用,不过车主卖电收益抵不过电池损耗。
5.2万星项目Ghostty逃离GitHub!
广受欢迎的开源终端Ghostty将离开GitHub,其创造者Mitchell Hashimoto称GitHub故障频发,严重妨碍工作。此事引发开发者共鸣,有人剖析原因指向运营策略和AI自动化泛滥,也让其他开发者心生去意。
突发,Fable 5.1泄露了!Claude又叒叕全球大宕机
今日,Fable 5.1被曝开启灰度测试,部分Claude用户已免费试用。推测其可能很快全量推送且不涨价。此前Fable 5因性能强受限,开发者期待5.1版。同日Claude全球大宕机,Anthropic正冲刺万亿估值。