扩散图像生成」共找到 2494 篇相关文章

推荐文章7

用AI深读100本书,太上头了~

国外开发者Pieter让Claude深读100本非虚构类书籍,用AI‘深化’阅读。AI能在书间找联系,还生成奇葩分类并挖出洞见。实验带来三个启发,还给出低成本复制思路,强调学习要让知识建立连接。

CourseAI
推荐文章7

2026 年的 Coding 时刻是 Excel

近期Claude Code推出的Excel功能惊艳,Altiemeter合伙人Freda Duan认为,Excel或成下一个快速爆发的高价值领域,像Coding一样,它有庞大用户基数、可延展场景及自助式采用特点,变革或扩散到办公体系。

海外独角兽
推荐文章7

LightX2V Ulysses Attention 实现学习笔记

本文记录了LightX2V中Ulysses Attention的实现方式与张量形状推导。在多模态/视频场景,其实现可概括为一种layout变换,还提供`enable_head_parallel`和`use_fp8_comm`选项,效果受运行环境等因素影响。

GiantPandaLLM
算法论文8

Gemini准确率从21%飙到97%!谷歌只用了这一招:复制粘贴

Google Research研究发现,将输入问题复制粘贴一遍,能让大模型在非推理任务上准确率惊人提升,如Gemini 2.0 Flash - Lite从21.33%升至97.33%,且几乎不影响生成速度,但不适用于推理场景。

新智元
算法论文7

用超图撕开知识边界:16万节点无师自通搞Agentic科研

传统知识图谱只能用三元组描述世界,难以应对真实科学场景里的多体交互。作者提出将文献里n元关系存成超图超边,让LLM在多智能体框架里‘沿着超边走路’,并构建了超图进行实验,实现可验证的科学发现。

PaperAgent
新闻资讯8

不得了,这个新技术把视频压缩到了0.02%!

中国电信人工智能研究院的生成式视频压缩(GVC)技术,将视频数据压缩率干到0.02%,还能保持画面高清连贯和细节。它以‘用计算换宽带’为核心理念,在实测中表现优异,有诸多应用场景。

量子位
新闻资讯7

利用Loop语言模型扩展隐式推理 | 直播预约

当前大语言模型依赖显式文本生成推理,未充分利用预训练数据。将介绍最新工作Ouro,Loop语言模型家族,核心创新多,虽参数少却性能优,还会讨论其推理轨迹及模型Scaling新可能。

深度学习自然语言处理
新闻资讯8

Scaling Law 仍然成立,企业搜广推怎么做才能少踩“坑”?

InfoQ《极客有约》X AICon 直播栏目邀请京东、荣耀等专家探讨生成式推荐落地洞察。指出搜广推领域 scaling law 仍成立,大模型改变特征工程等,还分享了系统架构、模型应用等方面经验及挑战。

InfoQ
产品应用8

Nano Banana Pro最全解析,设计师和开发者都用得上,附官方提示指南

Nano Banana Pro基于Gemini 3 Pro构建,将逻辑推理能力注入像素生成,解决画面准确性、逻辑性问题。它在多方面实现飞跃,应用广泛,谷歌还给出提示词使用技巧,但在部分处理上仍有提升空间。

AIGC开放社区
新闻资讯7

Nano Banana 2突然现身!能画公式解数学题,监控画面都能伪造

Nano Banana 2代以预览版现身第三方网站,后被移除。其能力远超1代,能处理复杂提示,可生成复杂UI、解数学题甚至伪造监控画面。谷歌正将Nano Banana整合进核心产品生态。

量子位