diff --git a/comfy/ldm/modules/attention.py b/comfy/ldm/modules/attention.py index 363dd89bb..b321bb081 100644 --- a/comfy/ldm/modules/attention.py +++ b/comfy/ldm/modules/attention.py @@ -260,7 +260,7 @@ def attention_split(q, k, v, heads, mask=None, attn_precision=None): end = i + slice_size if upcast: with torch.autocast(enabled=False, device_type = 'cuda'): - s1 = einsum('b i d, b j d -> b i j', q[:, i:end].to(dtype=torch.float32), k.to(dtype=torch.float32) * scale + s1 = einsum('b i d, b j d -> b i j', q[:, i:end].to(dtype=torch.float32), k.to(dtype=torch.float32)) * scale else: s1 = einsum('b i d, b j d -> b i j', q[:, i:end], k) * scale