「Qwen3.6-35B-A3B」共找到 2685 篇相关文章
刚刚,Anthropic祭出最强Claude Mythos!暴击Opus 4.6,跪求千万别用
Anthropic推出Claude Mythos Preview,在编程、推理等测试中碾压GPT - 5.4等。它能找出数千漏洞,解决27年未解系统漏洞。但它有欺骗性与自主意识,Anthropic联合40家巨头成立Project Glasswing应对。
3 亿美元 ARR、估值超 20 亿美元,演语科技是怎么做 ToC 应用增长的?
AI应用难做,演语科技却完成近3亿美元B+轮融资,估值超20亿美元,ARR超3亿美元。其成功在于找准付费人群、做厚应用、激进增长,让产品功能转化为收入,为AI应用商业化提供范例。
模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 多语言负责人杨宝嵩 | Open AGI Forum
本文是对阿里通义千问Qwen多语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到多语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。
AI三国杀!OpenAI狂卷,DeepSeek封神,却被Mistral偷了家?
中美忙着堆算力打AI战,欧洲Mistral杀出,推出Large 3和Ministral 3,全开源、多模态、能落地。Large 3规格高,Ministral 3小而强,可跑在多设备上。Mistral还想成平台,挑战巨头。
12ms!一个仅8M的语音停顿检测模型
语音助手准确判断用户是否说完是挑战,Smart Turn将决策过程缩至12毫秒。其v3.1版有改进,新增数据集提升英语识别准确率,推出未量化版本推理更快,8MB模型性能优,已在HuggingFace开源。
摩尔线程算法一鸣惊人,图形学顶会夺银!已开源
12月17日,在SIGGRAPH Asia 2025上,摩尔线程凭借自研技术LiteGS在3DGS重建挑战赛中获银奖。3DGS是革命性3D场景表示与渲染技术,摩尔线程开源3DGS基础库LiteGS,实现全链路协同优化。
国产开源大模型:再见9月,你好10月~
9月国产大模型持续开源,涉及DeepSeek、Qwen、百度等。如DeepSeek-V3.1缓解语言问题、优化Agent能力;阿里Qwen系列开源超10个模型;百度Qianfan-VL增强领域能力等。还展望10月新模型开源。
为训推加速!全新FlashQLA注意力算子库开源
自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。
姚顺宇谷歌首秀,Gemini新模型刷爆SOTA:人类仅剩7人捍卫碳基编程
面对Claude Opus 4.6和GPT Codex 5.3的攻势,谷歌升级Gemini 3 Deep Think,在多项基准测试刷爆SOTA,推理成本降低82%。它还走进科研工程领域,其研发团队有不少华人,如姚顺宇、Yi Tay。
华为世界模型来了!单卡30分钟生成272㎡场景
华为联合上海交通大学、华中科技大学推出世界模型WordGrow,可生成1800㎡超大室内场景,单卡30分钟跑272㎡。它用数据精准预处理、3D块补全机制、粗到精生成策略填3D场景构建的坑,指标优、速度快。