Qwen3.6-27B」共找到 2694 篇相关文章

新闻资讯7

腾讯急了!同时放出3只龙虾,龙虾生态加速

龙虾(OpenClaw)持续火爆,成为两会热议话题,大厂纷纷入局。腾讯坐不住,3月6日线下提供龙虾服务,现又推出3只龙虾,包括企业微信接入、WorkBuddy远程控制及QClaw内测,解锁无限可能。

AIGC开放社区
开源动态8

Nanbeige4.2-3B:探索通用Agent小模型

在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。

AIGC开放社区
产品应用7

混元 Hy3 发布:99% 的任务,够用了

腾讯混元模型 Hy3 正式上线,免费使用两周。它是快慢思考融合的 MoE 模型,主打 Coding 和 Agent 场景,性价比高。作者用它做了多项测试,如制作 PPT、开发代码、舆情分析等,还与 GLM - 5.1 对决,表现不错。

AGI Hunt
开源动态8

有了它,太丝滑啦,5.3k Star ai-memory!!!

Claude Code 与 Codex 切换时需重述项目情况,5.3k Star 的 ai-memory 解决此问题,它将 Agent 生命周期信息整理成可 Git 管理的 Markdown Wiki,提供可审计的交接班机制。

小华同学ai
产品应用8

刚刚,DeepSeek官宣V3.1发布,Agent 能力较大提升

DeepSeek官宣V3.1发布,核心特性有混合推理架构、思考效率提升、Agent能力增强。产品形态含官方App/网页端和API升级。性能在编程、搜索智能体及思考效率上显著提升。

PaperAgent
开源动态8

史上最大高质量科学推理后训练数据集开源,快速让Qwen3等变“科学家”

上海创智学院、上海交通大学发布开源科学推理后训练数据集MegaScience,含约125万条问答对,覆盖多学科。它解决了现有数据集的问题,实验显示能提升模型科学推理能力,已完整开源相关组件。

量子位
开源动态8

Mamba 架构实现推理性能超 Gemma3-27B!推理模型开始迈入「无注意力」时代

PromptCoT - Mamba是首个具解码显存常量等特性且推理能力强的模型。当前推理大模型中注意力机制有局限,PromptCoT - Mamba实现无注意力推理,在多评测集超Transformer等模型,为无注意力推理生态奠基。

AI科技评论
算法论文8

Qwen突破:用「并行计算」代替「堆参数」,新方法内存降22倍、延迟降6倍

LLM进化依赖「堆参数」,存在训练成本高、推理慢等问题。论文提出ParScale,用「并行计算」代替「堆参数」,让模型「分头思考」,推理效率提升22倍,旧模型也能改造,落地价值大。

深度学习自然语言处理
新闻资讯8

美国ATOM报告:Qwen称霸武林,中国统治开源世界

美国ATOM报告显示,2025年夏中国开源语言模型超美国,下载、使用量差距显著。Qwen成王者,DeepSeek在大模型领域表现出色。新势力如Nvidia、OpenAI等也在追赶,报告引入新指标衡量模型热度。

AIGC开放社区
产品应用7

3D-AIGC 存储架构演进:从 NFS、Gluster 到 JuiceFS

光影焕像在 3D-AIGC 存储上,因三维模型数据量大、格式多,对存储要求高。经探索,从 NFS、GlusterFS 到最终选 JuiceFS,搭建统一存储平台,管理上亿文件,提升处理速度,简化运维。

InfoQ