千问Qwen」共找到 661 篇相关文章

算法论文8

ACL 2026 | 中科大&上海AILab揭示强化学习后训练的Scaling Law

中国科学技术大学和上海人工智能实验室等团队,在Qwen2.5和Llama 3模型开展研究,揭示强化学习后训练的Scaling Law,提出幂律公式预测模型学习效率与训练轨迹,成果被ACL 2026接收。

机器之心
产品应用7

龙虾更新出了大bug,12小时内紧急发新版

龙虾火速更新到OpenClaw 2026.3.23版本,距3.22版本仅12小时。此次更新光速修复UI崩溃,接入DeepSeek和Qwen家族,完善插件API兼容性,还在UI、模型、安全等方面有改进。

量子位
推荐文章7

OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态大模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型。

CourseAI
新闻资讯7

中科闻歌完成新一轮战略融资,引领企业级人工智能技术发展

近日,中科闻歌完成新一轮战略融资,投资方为石景山区产业基金。融资用于自研决策智能操作系统DIOS研发与推广。中科闻歌技术实力强,有全栈自研体系,已服务超家客户,后续将深耕多领域并拓展海外市场。

量子位
产品应用8

面壁MiniCPM-V4.5新王炸!8B手机10FPS长视频秒懂,文档手写全能识别!

面壁上新最强端侧多模态模型MiniCPM-V 4.5,基于Qwen3 - 8B与SigLIP2 - 400M构建,总参数量8B。它视觉语言理解强、手机能跑,有高帧率视频理解等特点,还有多方面技术亮点。

CourseAI
开源动态8

The Batch: 849 | 用于训练网页智能体的生成数据

开发网页智能体常需大量人力标注训练样本,卡内基梅隆大学与亚马逊团队实现训练数据生成自动化。他们构建数据集,通过智能体工作流程生成数据,微调后 Qwen3 - 1.7B 表现出色,还公开数据与方法。

DeeplearningAI
开源动态7

如何重现 DeepSeek 推理性能突破

DeepSeek-V3 是热门开源大模型,采用大规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。

InfoQ
新闻资讯7

Slack 淘汰 SSH:700+ EMR 作业迁移至基于 REST 的调度架构

Slack 完成大规模数据平台改造,将 Amazon EMR 数据处理流程中 SSH 作业执行模式替换为基于 REST API 的统一调度架构,移除对生产集群的直接 SSH 访,迁移 700 多个 Airflow Operator,解决了安全、运维等题。

InfoQ
产品应用7

夸克 AI 对话助手的邪修打开方式:一句话直通网盘,看电影、找资料全拿下

阿里“C计划”首个成果,夸克App深度整合对话助手,用Qwen3 - Max模型。可随意切换模式,其独特之处是提资料或电影,能直返夸克网盘链接,“搜、用、存”一气呵成,与其他AI助手不同。

AI进修生
新闻资讯7

刘强东连投3家具身智能!京东美团「战火」烧到外卖之外

王兴之后,刘强东在具身智能领域发力,最新一轮出手领投3家公司,包括寻智能、众擎机器人、逐际动力。此前美团也投资2家相关公司。京东还在内部成立业务部门,强调场景落地。

量子位