Qwen-Image-2.1」共找到 3563 篇相关文章

产品应用7

Claude Fable 5.1 发布:缓存读降价 75%,但实际更贵了

Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1。Fable 5.1 性能全面上涨,但出现价格悖论,缓存读降价 75% 实际更贵。在 Agent 类任务与 Opus 5 基本持平,推出 EFS 应对数据留存争议,还有多项科研演示。

AI工程化
开源动态7

谷歌将 A2A 捐赠给 Linux 基金会,但代码实现还得靠开发者自己?!

当地时间 6 月 23 日,Linux 基金会宣布与多公司成立 A2A 项目,由谷歌捐赠协议规范等。A2A 支持智能体通信协作,谷歌称其将在中立治理下开发普及。此外还对比了 A2A 与 MCP、ACP 等协议,探讨实际应用问题。

InfoQ
产品应用8

国产芯片也能跑AI视频实时生成了,商汤Seko 2.0揭秘幕后黑科技

自Sora 2发布,科技厂商掀起视频生成模型竞赛。12月15日商汤上线Seko 2.0,实现AI短剧‘一人剧组’。其背后的LightX2V框架做到实时生成,还适配国产芯片,有望推动视频创作生产力革命。

机器之心
产品应用8

拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」

Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,将‘智力’与‘权限’物理剥离。前者负责通用任务,后者面向专业场景。此次更新展示模型解决长时任务状态一致性等问题的能力,还体现了能力权限分离等变化。

AI科技评论
开源动态8

离谱……面壁让 AI 写了个训练框架,然后它自己训出了最强的 1B 模型:MiniCPM5-1B

面壁发布 1B 参数量级最强端侧文本大模型 MiniCPM5 - 1B,其 Base Model 由 AI 编写的训练框架 ForgeTrain 训出,速度超英伟达 Megatron 10%。该模型性能出色,部署门槛低,数据治理方案对应数据集也已开源。

AGI Hunt
产品应用7

Qwen深度研究一夜升级!可生成网页和音频播客,新模型能认医生手写体

Qwen版深度研究加速进化,增加听觉和视觉输出,可生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后性能优异。

量子位
新闻资讯7

Vercel CEO爆Kimi K2智能体准确率超GPT-5 50%?国产的风还是吹到了硅谷

Vercel CEO称内部测试中,国产Kimi K2模型运行速度和准确率均优于GPT - 5和Claude Sonnet 4.5。硅谷多家公司已接入或转用K2,K2 Agent能力也经受住检验,还给出使用和价格相关信息。

AI寒武纪
产品应用7

实测DeepSeek V3.1,不止拓展上下文长度

文章实测了DeepSeek V3.1和V3,发现V3.1在编程、写作、翻译等方面有变化,如编程更全面、写作风格变文艺等。网友测试其在aider得分71.6%成非推理模型SOTA,但线上API有问题。

量子位
开源动态8

The Batch: 859 | Qwen3 的自主智能新进展

不到两周前 Kimi K2 超越其他开源非推理模型,如今阿里巴巴发布基于早期 Qwen3 - 235B - A22B 的三款新大语言模型权重,介绍了输入输出规格、架构设计、性能表现、使用方式等,还进行了性能对比。

DeeplearningAI
算法论文7

R1/Qwen训练新范式:无需继续训练,直接“算”出权重,提效500%

DeepSeek - R1爆火让RLVR成大模型后训练焦点,但训练代价高昂。学者发现RLVR中LLM权重和输出概率呈线性变化,提出“权重外推”等方法,实现最高6.1倍训练加速,RL - Extra在多榜单展现高效率。

PaperAgent