「图像生成加速」共找到 2914 篇相关文章
不只DeepSeek,阶跃等开源JetSpec:大模型解码提速近10倍
近期,DeepSeek 推出 DSpark,阶跃星辰提出 JetSpec,都关注大模型推理效率。DSpark 关注验证效率,JetSpec 提高有效 Token 生成率。二者切入点不同,但都显示大模型行业进入新阶段,推理效率成 Agent 落地基础变量。
分享5个Claude Code + 飞书的超实用Agent办公玩法。
本文分享Claude Code与飞书结合的5种办公玩法,如为会议系列建知识库、工作复盘、自动化对接流程、生成协同画板、自动报销审批等,还介绍飞书CLI能力及安装方式,展现其提效与协同潜力。
Seedance 2.0之后,又一中国视频模型SkyReels-V4登上全球第二
昆仑天工发布SkyReels V4视频大模型,在Artificial Analysis Arena基准测试中排全球第二。它支持多模态输入、音视频同步生成等,采用独特架构与技术,经多阶段训练,有全新评估基准,表现出色。
基于DINOv2和SAM2改进的U-Net模型
DSU-Net是基于DINOv2和SAM2改进的U-Net模型,通过多尺度跨模型特征协作和轻量级适配器模块,解决现有图像分割模型在特定下游任务表现不足问题,提升分割精度,降低训练成本。
「死亡互联网理论」刷屏硅谷!Reddit创始人预警,奥特曼公开发声
近段时间,「死亡互联网理论」刷屏硅谷,Reddit联合创始人称互联网被AI内容淹没,失去了真实的生命力。OpenAI创始人Sam Altman也认同其有一定道理。如今AI浪潮加速了互联网「死亡」,还可能带来模型崩溃。
RSS 2025 软硬件全开源,智源清华带来混动灵巧脸Morpheus
清华大学赵昊团队联合多家机构发布高拟真机器人面部系统Morpheus,融合三项关键技术,能实时生成多种细腻表情。它在核心指标表现出色,有三大创新突破传统瓶颈,为下一代情感机器人奠定技术基座。
AI 领域最''不务正业''的团队,可能做了一件最正确的事
马卡龙是一款主打帮助用户更好生活的个人智能体,有深度记忆和生成定制化生活场景小应用两大核心特点。它区别于生产力智能体,有技术积累,基础聊天免费,开发小应用收费。
The Batch:836 | 基准测试成本攀升
独立AI测试实验室披露评估推理模型成本上升。这些模型生成“思维链”提升输出质量,但计算需求增加,成本上升使资源有限组织难复现结果,且新模型定价、按需分配推理token也让成本更复杂。
在 Cache-DiT 框架下实现原生 Serving功能
Cache-DiT 是唯品会开源的 PyTorch 原生 DiT 推理加速引擎,此前聚焦离线推理。现实现完整 Serving 功能,支持单卡与分布式推理模式。文章介绍其实现过程、借鉴 SGLang 的设计,还总结踩坑及使用方法。
陈丹琦新作:大模型强化学习的第三条路,8B小模型超越GPT-4o
陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越大模型,推理更像人类。