Qwen系列」共找到 720 篇相关文章

新闻资讯7

为什么林俊旸会离职? | 甲子光年

3月4日凌晨,阿里Qwen团队技术负责人林俊旸宣布离职,同一天Qwen后训练负责人郁博文也正式离职。阿里刚开源Qwen 3.5小尺寸模型获马斯克点赞,此时核心团队出走引发关注。林俊旸离职或因团队分拆、管理范围缩小及“开源”与“闭源”的矛盾。

甲子光年
产品应用7

终于轮到 AI 上夜班了,我去睡

Qoder 推出 Qwen3.7-Max 和 Qwen3.7-Plus 错峰折扣,白天 08:00 到 22:00,Qwen3.7-Max 5 折;22:00 到次日 08:00,Qwen3.7-Max 2 折,Qwen3.7-Plus 4 折。作者测试后认为适合内容创作者,还给出使用建议。

AI产品黄叔
新闻资讯8

模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 多语言负责人杨宝嵩 | Open AGI Forum

本文是对阿里通义千问Qwen多语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到多语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。

AI科技大本营
开源动态8

为训推加速!全新FlashQLA注意力算子库开源

Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。

千问大模型
新闻资讯8

国产手机卖到1万6!华为新旗舰,搭载麒麟9030

华为年度旗舰Mate 80系列和折叠屏旗舰Mate X7携全新麒麟9030系列芯片亮相。首发鸿蒙6操作系统,小艺进化成智能体。Mate 80系列首发第二代红枫影像,Mate X7影像模组升级。价格上,Mate 80系列起售4699元,Mate X7高配达15999元。

量子位
产品应用8

你们催更的模型,云栖大会一口气全发了!

云栖大会上新6款模型、发布1个全新品牌,覆盖多场景。如Qwen MAX万亿参数大模型能力登顶国际榜单,Qwen3 - Omni实现全模态不降智等,各模型能力升级显著,现已同步上线。

阿里云开发者
新闻资讯7

GPT-5系列咋都爱说「哥布林」?原因找到了

OpenAI发布博客解释模型迷上「哥布林」的原因。原来是训练“Nerdy”人格时,奖励信号偏爱怪物词汇,强化学习将风格固化并扩散到普通对话。此前DeepSeek V3.1也出现过「极」字Bug。

机器之心
算法论文8

SRO赋能Qwen-2.5-VL推理性能飙升16.8%

文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。

CourseAI
新闻资讯7

林俊旸果然创业了!一个“Qwen负责人”头衔值135亿

前阿里千问大模型负责人林俊旸离职后创业,种子轮目标估值20亿美元。他曾深度参与阿里多个大模型项目,离职首篇长文提出“Agentic Thinking”,或为创业方向。

量子位
算法论文7

Qwen负责人转发2025宝藏论文,年底重读「视觉领域GPT时刻」

2025年末,Qwen大模型技术负责人林俊旸转发谷歌DeepMind入选ICCV 2025的论文,指出视觉领域“GPT时刻”要来了。研究用实验数据证明,视频模型正跳出任务专属局限,实现一个模型完成多视觉任务,推理过程还能被CoF“演”出来。

量子位