《黄粱》· 开场 8–11s 倒米段 · 本地 RTX 4090

SeedVR2 超分:1080 档 vs 4K 档

拖动分隔线比较。四块裁切都是 4K 档的 100% 像素,1080 档放大到同尺寸对齐——所以你看到的差异是真实的信息量差异,不是显示尺寸差异。

1470×630 1080 档 2520×1080 4K 档 3840×1646 4K 耗时 9:40 4K 峰值 11.30 GB

先说结论:4K 档反而更自然

1080 档锐是锐,但皮肤对比度被推高、边缘发硬——典型的 oversharpen。4K 档须发更连续、皮肤过渡更柔和,没有塑料味。

这跟"分辨率越高越锐"的直觉相反,但说得通:给模型更多像素去表达细节,它就不需要靠推对比度来伪造锐度。对我们这种 AI 生成源、又要保胶片颗粒的素材,高分辨率档方向更对。代价是慢 2.3 倍。

脸与须发

须发是否根根分明,同时脸不能变蜡像

脸与须发 4K 档 脸与须发 1080 档
1080 档4K 档

夯土墙与蒸汽

最关键:平坦+半透明区最容易被凭空编纹理

夯土墙与蒸汽 4K 档 夯土墙与蒸汽 1080 档
1080 档4K 档

陶盆与米粒

道具形制是否被改写

陶盆与米粒 4K 档 陶盆与米粒 1080 档
1080 档4K 档

手部皮肤

塑料感最先出现在这里

手部皮肤 4K 档 手部皮肤 1080 档
1080 档4K 档

4K 成片(3840×1646)

batch 5 + BlockSwap + VAE tiling,x265 10bit。动态下才判得出颗粒真假。

跑测战绩

同一段素材(72 帧),逐档实测。失败的也列出来——它们定义了这张卡的边界。

档位输出batchdec tile结果耗时峰值显存
1080 档2520×10802110244:0717.96 GB
1080 全关 tiling21❌ 编码 OOM
1080 只留 enc tiling21❌ 解码 OOM80s 白跑
4K 档3840×164691024❌ 解码 OOM
4K 档3840×1646510249:4011.30 GB
4K 档3840×16469768跑测中

阶段耗时拆解

VAE 解码是两档共同的大头。两个 tiling 都试过关掉,各自在对应阶段 OOM——省不掉。

阶段1080 档占比4K 档占比
VAE 编码38.5s16%125.4s22%
DiT 上采样26.5s11%160.7s28%
VAE 解码173.5s70%289.4s50%
后处理2.8s1%12.3s2%

模型选型:不升级 ComfyUI

官方新出的 INT8 / NVFP4 / MXFP8 量化版要走 ComfyUI 原生支持,得升级本体(与登仙阁 LTX 工作流共用)。查完账发现不值:NVFP4 与 MXFP8 是 Blackwell 专属,4090 是 Ada 架构没有对应指令;INT8 的 7B 约 7.5GB,而现成 GGUF 的 7B Q4_K_M 只有 4.43GB,官方对 Q4 的评价是"不做 A/B 你根本看不出来"。升级换不来东西。

正在下的三个:7B fp8 mixed(官方修 artifacts 版)、3B Q8_0(社区评最佳,3.41GB)、7B Q4_K_M(4.43GB)。到齐后同参数横评。