「Qwen3.8-Flash-Next」共找到 1035 篇相关文章
御三家格局松动:Google和Meta同日发布新模型,第三名不再稳了?
2026年9月2日,Google推出Gemini 3.8 Flash,Meta发布Muse Spark 1.3。此前Google经历人事调整、旗舰延期,靠Flash维持节奏;Meta则重建团队、收窄战略。二者产品定位相似,各有优劣。
通义灵码编程智能体,上线!
近期 Qwen3 正式发布并开源 8 款「混合推理模型」,表现出色。通义灵码全面支持 Qwen3 并上线编程智能体,具备多种能力,支持配置 MCP 工具,集成魔搭 MCP 广场,能大幅提升开发效率。
为训推加速!全新FlashQLA注意力算子库开源
自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。
让AI自动生成工作流
不会搭建工作流没关系,可让AI自动生成。如用Claude帮搭建n8n工作流,它生成JSON文件,复制粘贴到n8n配置节点即可用。介绍n8n特点,还讲了Claude自动生成n8n工作流的操作步骤。
横扫海外的阿里大模型,有自己的APP了,叫“千问”
11月17日,阿里巴巴上线“千问App”,将Qwen系列模型装进面向C端用户的独立App。它设计极简,功能强大,免费使用。主模型为Qwen3,问答结构化,多模态交互方便,还有翻译等特色功能,背后是强大的Qwen模型生态。
你们催更的模型,云栖大会一口气全发了!
云栖大会上新6款模型、发布1个全新品牌,覆盖多场景。如Qwen MAX万亿参数大模型能力登顶国际榜单,Qwen3 - Omni实现全模态不降智等,各模型能力升级显著,现已同步上线。
8.8K Star!真正的本地实时 Whisper 开源神器,彻底干翻云端 STT!
做实时语音转文字系统,上云端 API 贵且隐私难保障,本地跑 Whisper 延迟高。WhisperLiveKit 是专为本地流式语音识别优化的全栈方案,解决了 Whisper 痛点,有极速处理等功能,适用多类项目。
8.8k星星!开源的211个专家级Agent,一键接入,一个人就是一个团队
今天推荐agency-agents-zh库,它是agency-agents深度汉化版,有211个精选Agent,适配国内生态。需注意,skill并非越多越好,按需选择,避免浪费资源和输出无效结果。
3.8K星爆款!Google「langextract」可视化溯源,信息抽取神器
Google的「langextract」在GitHub获3.8K星,是信息抽取神器。它有精准源定位、可靠结构化输出等特点,支持多种LLM,适用于各领域,文章还给出实战代码示例。
「Next-Token」范式改变!刚刚,强化学习预训练来了
微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,可利用海量文本数据进行通用强化学习。该方法有可扩展性、低风险等优点,实验显示其提升了语言建模能力。