「Qwen-Image-2.1」共找到 3583 篇相关文章
视频模型也能推理,Sora2推理能力超过GPT-5
DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。
3.2K star!!高中生开发,媲美IDM,这款开源下载神器厉害了!
最近发现一款开源项目Ghost - Downloader - 3,由高中生独立开发,支持三平台,用Python编写且运行快,还融入AI技术自动调教下载策略。已有3.2K star,功能强大,安装和使用都简单。
终于突破限制啦,11.2k Star LiveContainer,抓紧试一下!!!!
LiveContainer官方定义是app launcher,能将多个IPA以访客App形式放进运行环境加载,可在现有iOS规则里降低测试摩擦,获11.2k Star。但它并非虚拟机或强隔离沙箱,使用有诸多限制。
微软Build 2025大会Day 1:All in「智能体网络」,全面推动MCP
北京时间昨夜今晨,微软Build 2025开发者大会Day 1开场,CEO萨提亚·纳德拉透露“智能体网络”概念。大会展示微软在开发者工具、办公中枢、云平台等多方面进展,还宣布Microsoft Discovery平台加速科学突破。
两月蒸发1.6万亿:SaaS 被AI「杀死」了吗? | GAIR 025
今年初,北美软件股两月蒸发超1.6万亿美元,引发对SaaS未来的担忧。雷峰网圆桌中,何润、Daniel、吴昊三位行业老兵探讨现状与未来,认为AI冲击下,SaaS虽面临挑战,但不会被杀死,正全面转型。
LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析
文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍了该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述了数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式。
Qwen负责人转发2025宝藏论文,年底重读「视觉领域GPT时刻」
2025年末,Qwen大模型技术负责人林俊旸转发谷歌DeepMind入选ICCV 2025的论文,指出视觉领域“GPT时刻”要来了。研究用实验数据证明,视频模型正跳出任务专属局限,实现一个模型完成多视觉任务,推理过程还能被CoF“演”出来。
Jev的开源替代品,速度快7倍,内存不到1GB
本文介绍闭源决策模型Jev的开源替代品Laya,对比两者性能差异,分析Laya的优势与局限性,给出适用场景,为开发者提供选型参考。
编程能力开源SOTA,网络安全提升2倍!智谱发布GLM-5.3
智谱发布GLM-5.3,743B参数模型,编程能力达开源SOTA。网络安全能力涌现,基准得分是GLM-5.2两倍多。全部提升来自后训练缩放,还自研Z.ai Code Bench评估,安全评估加固后权重将开源。
Sora2还在5秒打转,字节AI生视频已经4分钟“起飞”
字节和UCLA联合提出Self - Forcing++方法,无需更换模型架构或重收集数据集,就能生成分钟级长视频,最长达4分15秒,高质量且开源,在长、短时长生成上性能领先。