混元图像3.0」共找到 3087 篇相关文章

产品应用8

火山引擎 veFuser:面向扩散模型的图像与视频生成推理服务框架

近年来扩散模型在图像和视频生成领域取得突破,但 DiT 模型推理面临计算量大、模型多样、实时性需求等挑战。火山引擎推出 veFuser 推理框架,能在图片和视频生成上实现低延迟、低成本的高质量体验,且未来会持续迭代。

InfoQ
产品应用7

Ollama升级模型调度系统:内存管理更精准,多GPU性能提升

Ollama升级模型调度系统,精确测量运行模型所需内存,带来内存崩溃减少、GPU利用率提高等改进。Gemma3、Mistral - small3.2等模型性能提升,更多模型正迁移,还在开发iGPU支持,评估NPU支持。

AI工程化
开源动态7

年底,国产开源LLM又迎来一波大爆发:Qwen、美团、智谱、腾讯、百川

年底国产开源LLM大爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式。

PaperAgent
开源动态8

14.9k Star!Firecrawl 开源的 PDF 智能分类器,200 份文档 0.47 秒搞定!

Firecrawl 开源 PDF 智能分类与文本提取库 pdf-inspector,已获超 1.4 万人标星。它能智能分类、感知提取、转 Markdown 及按需路由,性能炸裂,分类快,多项指标领先,还支持多平台。

开源星探
新闻资讯7

程序员从此不再写代码!红杉专访Codex团队,o3白菜价真相曝光

红杉专访OpenAI Codex团队,揭示AI编程未来。Codex从代码补全演化为智能体,强调委托心态,开发者从动手转向审核。还爆料OpenAI内部有递归自我改进的AI Alice。

新智元
算法论文8

一张照片,一个3D「你」:计算所等提出HumanLift,实现高保真数字人重建

中国科学院计算技术研究所等机构研究人员提出 HumanLift 技术,基于单张参考图像重建高斯网数字人全身。该技术融合三维视频扩散模型和人脸增强,仅需单张人体图片就能重建高逼真三维数字人。

机器之心
算法论文8

Anthropic让9个Claude Agent花5天做出比人类强4倍的对齐成果

Anthropic发表Automated Weak - to - Strong Researcher,用9个并行的Claude Opus Agent组成自动化研究团队,5天就把PGR从人类的0.23提升到0.97,成本约$18,000,证明AI自动化研究可行。

PaperAgent
新闻资讯7

蚂蚁阿福:从 0 到生产的医疗 Agent 工程化落地|QCon 北京

4月16 - 18日QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题,有百余落地案例。蚂蚁集团郭春晓将分享《蚂蚁阿福:从0到生产的医疗Agent工程化落地》,探讨构建技术体系等内容。

InfoQ
新闻资讯7

蚂蚁阿福:从 0 到生产的医疗 Agent 工程化落地|QCon 北京

4月16 - 18日,QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题。蚂蚁集团郭春晓将分享《蚂蚁阿福:从0到生产的医疗Agent工程化落地》,探讨技术体系与布局,还有20多个专题论坛。

InfoQ
新闻资讯8

华为创造AI算力新纪录:万卡集群训练98%可用度,秒级恢复、分钟诊断

大模型落地需强大算力集群支撑,构建万卡级算力集群是顶尖挑战。华为昇腾万卡算力集群近乎‘永不罢工’,其公开技术秘密,提出‘3+3’双维度技术体系,多项指标表现优异。

量子位