大模型Yan 2.0」共找到 8666 篇相关文章

开源动态8

阿里开源14B电影级视频模型!实测来了:免费可玩,单次生成时长可达分钟级

昨夜阿里发布14B视频模型Wan2.2 - S2V,仅需一张图片和一段音频,就能生成电影级数字人视频。该模型发布即开源,可在通义万相官网免费体验,单次生成时长可达分钟级。

量子位
产品应用8

MiniCPM 4.0来了!220倍极速狂飙,端侧模型的比赛,结束了

面壁智能联合清华发布MiniCPM 4.0,极限场景220倍加速。它是首个原生稀疏模型,有三级火箭推理加速体系,性能强,适配全平台,应用广泛,或成端侧AI分水岭。

AGI Hunt
产品应用8

可灵3.0系列模型正式上线:属于每个人的导演时代来临

可灵AI正式全球上线3.0系列模型,覆盖影视级全流程链路。该系列基于All-in-One理念构建,解决了行业一致性等问题,在多方面做了增强,完成从单点生成到专业调度的跃迁,让AI成创作协作者。

AI科技评论
开源动态8

只有0.9B的PaddleOCR-VL,却是现在最强的OCR模型

近期OCR赛道火热,作者应读者要求解读PaddleOCR-VL。它是百度PaddleOCR系列新模型,仅0.9B参数,在OmniDocBench v1.5评测多项领先。其架构高效,实测处理各类文档能力强,已开源。

数字生命卡兹克
产品应用8

突破遥操瓶颈!全新无本体数据世界动作模型Noe-0发布

穹彻智能发布世界动作模型 Noe - 0,全链路采用无本体采集数据。其数据来自真实环境,配合 World Action Model 架构和 AI - Native 数据基础设施,跑通从真实世界经验到机器人能力转化的完整链路,是具身智能的里程碑。

机器之心
开源动态8

杨植麟亲自发布,月之暗面最强模型Kimi K2.5开源

杨植麟发布月之暗面最强模型Kimi K2.5,经约15万亿视觉与文本混合数据预训练,有顶尖编程与视觉能力及智能体蜂群范式。在多基准测试表现优,成本低于对手,还能提升办公生产力。

AIGC开放社区
开源动态8

扣子开源全家桶,Apache 2.0加持,AI Agent又一次卷到起飞

7月26日,新一代AI Agent开发平台扣子(Coze)宣布开源零代码开发平台(Coze Studio)和调试工具扣子罗盘(Coze Loop)。二者结合已开源的Eino框架,为开发者提供全栈可用、可复用的开发工具,还采用宽松的Apache 2.0协议。

机器之心
产品应用7

Seedance 2.0现象级刷屏!深度测评:复杂场景贼稳,连asmr都会?

字节上线的Seedance 2.0全网刷屏,马斯克怒赞,外国网友催更。它在多模态输入上升级,画面一致性更稳可控,还有一镜到底、完整剧情输出功能,视频长度和音效也能DIY,虽有小bug,但日常创作够用。

量子位
开源动态7

24张图,从GPT-2到gpt-oss,看OpenAI开源模型技术演进

2025年8月OpenAI释出gpt-oss-20b与gpt-oss-120b两个开源权重模型。文章梳理了从GPT - 2到gpt - oss的技术演进,拆解关键创新点,对比了与Qwen3的差异,介绍训练推理细节、实测体验及与GPT - 5跑分对比情况。

PaperAgent
开源动态8

RAG2.0进入“即插即用”时代!清华YAML+MCP让复杂RAG秒变“乐高”

检索增强生成系统(RAG)复杂度提升,开发者面临高昂工程成本。基于MCP架构的UltraRAG 2.0框架,让科研人员用YAML文件声明复杂逻辑,降低技术门槛与学习成本,还提升了复杂多跳问题性能。

CourseAI