「透明图生成」共找到 2497 篇相关文章
【万字长文】大模型开源开发全景与趋势解读
本文以蚂蚁开源团队视角,基于OpenDigger数据,分析大模型开源开发生态。呈现2025年全景图,涵盖135项目。指出训练、推理、应用侧主导领域,还探讨生态趋势、项目兴衰及近期厂商动态。
这家 AI Lab 宣布所有模型无限期免费后,我顺手做了个图片版番茄钟
全球排名前十的 AI Lab,Agnes 宣布旗下核心全模态模型 API 无限期免费开放,包括文本、图片、视频。还新增百万 Token 上下文和 4K 图片生成功能。作者用其做了图片版番茄钟,官方也公开开发进度。
Opus5.5代码直出视频刷屏!审美暴打GPT
本文报道Claude Opus 5.5突袭上线后,网友大量实测,用它纯代码生成视频、3D建模、UI、可交互游戏等内容,该模型性能提升价格下降,表现优于GPT等竞品,引发科技圈刷屏热议。
爆火一周后,Jev正式全面开放:一个“不会说话”的AI,为何风靡硅谷?
本文报道爆火硅谷一周的AI模型Jev正式全面开放,该模型由前OpenAI研究员团队打造,不同于传统大模型,不聊天不生成文本,仅做结构化判断,主打低成本快决策,引发开发者圈热议。
不只DeepSeek,阶跃等开源JetSpec:大模型解码提速近10倍
近期,DeepSeek 推出 DSpark,阶跃星辰提出 JetSpec,都关注大模型推理效率。DSpark 关注验证效率,JetSpec 提高有效 Token 生成率。二者切入点不同,但都显示大模型行业进入新阶段,推理效率成 Agent 落地基础变量。
分享5个Claude Code + 飞书的超实用Agent办公玩法。
本文分享Claude Code与飞书结合的5种办公玩法,如为会议系列建知识库、工作复盘、自动化对接流程、生成协同画板、自动报销审批等,还介绍飞书CLI能力及安装方式,展现其提效与协同潜力。
Seedance 2.0之后,又一中国视频模型SkyReels-V4登上全球第二
昆仑天工发布SkyReels V4视频大模型,在Artificial Analysis Arena基准测试中排全球第二。它支持多模态输入、音视频同步生成等,采用独特架构与技术,经多阶段训练,有全新评估基准,表现出色。
开源即登榜!登顶全球前十AI编程智能体,UCL初创团队开源Prometheus
UCL初创团队EuniAI开源AI软件智能体Prometheus,在SWE - bench Verified上Pass@1达71.2%,成绩入官方主榜。它有图结构推理设计,能理解代码,成本低,官网有Demo展示其工程化能力。
谢赛宁新作:VAE退役,RAE当立
谢赛宁团队研究表明VAE时代结束,RAE将接力。RAE是用于扩散Transformer训练的新型自动编码器,能提供高质量重建结果,有语义丰富潜空间,支持可扩展架构,收敛快,在ImageNet图像生成效果强劲。
RSS 2025 软硬件全开源,智源清华带来混动灵巧脸Morpheus
清华大学赵昊团队联合多家机构发布高拟真机器人面部系统Morpheus,融合三项关键技术,能实时生成多种细腻表情。它在核心指标表现出色,有三大创新突破传统瓶颈,为下一代情感机器人奠定技术基座。