千问大模型」共找到 7813 篇相关文章

开源动态8

一周10来个模型被开源,阿里Qwen杀疯了~

阿里通义这周开源众多模型,如Qwen3 - Omni、Qwen - Image - Edit等,涉及全模态、图像编辑、安全审核等多领域。各模型能力出色,如Qwen3 - Omni能处理多模态输入,Qwen3 - VL表现超部分闭源模型

PaperAgent
推荐文章8

芯穹曾书霖谈 AI 2.0 时代的大模型推理:从模型到硬件的协同优化

本文整理自无芯穹总经理曾书霖博士在 2025 年 QCon 全球软件开发大会演讲。他介绍软硬件协同优化提升智能系统能效成果,结合华为昇腾集群实践,探讨 AI 推理系统演进趋势,还从云、端维度分享大模型推理实践与挑战。

InfoQ
开源动态8

开源Qwen一周连刷三冠,暴击闭源模型!基础模型推理编程均SOTA

通义卷疯了,Qwen3-Coder刚登场,全新开源Qwen3系列最强推理模型Qwen3-235B-A22B-Thinking-2507又刷新SOTA。一周内,通义完成开源三连,在基础模型、编程模型、推理模型方面均达全球开源最强。

量子位
算法论文8

不止Deep,更要Wide:清华、无芯穹发布多智能体系统WideSeek-R1,4B模型比肩671B模型

清华与无芯穹的RLinf团队提出「广度扩展」,发布多智能体系统WideSeek-R1。它采用「Lead-agent-Subagent」框架,经MARL端到端训练,4B模型在广度搜索任务表现比肩671B模型,且在标准QA任务也出色。

机器之心
新闻资讯7

:阿里第二次“无线战争”

本文以乔布斯用 iPhone 点咖啡引出当下科技圈流行发布会点咖啡展示 AI 能力,对比过去与现在,指出数字世界核心范式从移动转向 AI。介绍阿里饱和式投入情况,还分析其可能借鉴拼多多、抖音策略,站在长尾对立面。

乱翻书
新闻资讯7

阿里干死豆包图疯传,:相煎何太急;字节大幅涨薪,传年利润或达500亿刀;印度AI妖股近两年暴涨550倍,仅2名员工|AI周报

这篇 AI 周报涵盖多领域动态。如阿里辟谣全员会干死豆包图;周鸿祎遭前高管实名举报财务造假;字节涨薪并推进 AI 手机合作;多家科技公司有新品发布或业务进展等。

AI前线
算法论文8

清华联手重塑归一化范式,让 Transformer 回归「深度」学习

Pre - Norm和Post - Norm是Transformer架构中稳定信号流的关键范式,但面临权衡取舍。近日,清华黄高团队联合团队提出SiameseNorm,构建参数共享的平行通路,实现稳定训练并提升性能。

机器之心
新闻资讯8

阿里落地谷歌UCP+A2UI,中国率先进入AI办事时代

谷歌联合零售巨头发布UCP和A2UI协议,试图定义智能体商务全球标准。而阿里App上线任务助理1.0,打通淘宝、支付宝等核心业务,接入多项生活与政务服务,快速落地应用,让中国进入AI办事时代。

AIGC开放社区
7

刚刚,杀入汽车座舱!阿里不止做超级APP,更要做超级入口

阿里AI助手被接入红旗汽车智能座舱,这是通用AI助手首次以完整形态登陆车载场景。能完成复杂语义理解和任务规划,还将拓展至更多硬件,阿里要把它打造成AI时代超级入口。

新智元
开源动态8

15个前沿大模型,100个职业场景:谁才是最强AI打工人?

通义与港中文联合发布OccuBench,用语言世界模型评测AI Agent职业能力。评测15个前沿模型,发现无全能选手,隐式故障难处理,Scaling定律有效,做Agent和环境模拟器能力不同,还给出具体案例。

AI科技评论