wanvideo ¶
Classes¶
fastvideo.models.dits.wanvideo.WanI2VCrossAttention ¶
WanI2VCrossAttention(dim: int, num_heads: int, window_size=(-1, -1), qk_norm=True, eps=1e-06, supported_attention_backends: tuple[AttentionBackendEnum, ...] | None = None, quant_config: QuantizationConfig | None = None, prefix: str = '')
Bases: WanSelfAttention
Source code in fastvideo/models/dits/wanvideo.py
Methods:¶
fastvideo.models.dits.wanvideo.WanI2VCrossAttention.forward ¶
Parameters:
| Name | Type | Description | Default |
|---|---|---|---|
x | Tensor | Shape [B, L1, C] | required |
context | Tensor | Shape [B, L2, C] | required |
context_lens | Tensor | Shape [B] | required |
Source code in fastvideo/models/dits/wanvideo.py
fastvideo.models.dits.wanvideo.WanSelfAttention ¶
WanSelfAttention(dim: int, num_heads: int, window_size=(-1, -1), qk_norm=True, eps=1e-06, parallel_attention=False, quant_config: QuantizationConfig | None = None, prefix: str = '')
Bases: Module
Source code in fastvideo/models/dits/wanvideo.py
Methods:¶
fastvideo.models.dits.wanvideo.WanSelfAttention.forward ¶
forward(x: Tensor, context: Tensor, context_lens: int)
Parameters:
| Name | Type | Description | Default |
|---|---|---|---|
x | Tensor | Shape [B, L, num_heads, C / num_heads] | required |
seq_lens | Tensor | Shape [B] | required |
grid_sizes | Tensor | Shape [B, 3], the second dimension contains (F, H, W) | required |
freqs | Tensor | Rope freqs, shape [1024, C / num_heads / 2] | required |
Source code in fastvideo/models/dits/wanvideo.py
fastvideo.models.dits.wanvideo.WanT2VCrossAttention ¶
WanT2VCrossAttention(dim: int, num_heads: int, window_size=(-1, -1), qk_norm=True, eps=1e-06, parallel_attention=False, quant_config: QuantizationConfig | None = None, prefix: str = '')
Bases: WanSelfAttention
Source code in fastvideo/models/dits/wanvideo.py
Methods:¶
fastvideo.models.dits.wanvideo.WanT2VCrossAttention.forward ¶
Parameters:
| Name | Type | Description | Default |
|---|---|---|---|
x | Tensor | Shape [B, L1, C] | required |
context | Tensor | Shape [B, L2, C] | required |
context_lens | Tensor | Shape [B] | required |