stages ¶
Classes¶
fastvideo.pipelines.basic.stable_audio.stages.StableAudioConditioningStage ¶
Bases: PipelineStage
Run the conditioner over the prompt + duration and stash the DiT-ready (cross_attn_cond, cross_attn_mask, global_embed) triple on batch.extra (plus the negative-prompt triple when CFG is on).
Source code in fastvideo/pipelines/basic/stable_audio/stages/conditioning.py
fastvideo.pipelines.basic.stable_audio.stages.StableAudioDecodingStage ¶
Bases: PipelineStage
Decode latent → audio waveform + slice to [start, end].
Source code in fastvideo/pipelines/basic/stable_audio/stages/decoding.py
fastvideo.pipelines.basic.stable_audio.stages.StableAudioDenoisingStage ¶
Bases: PipelineStage
k-diffusion dpmpp-3m-sde sampling loop.
Source code in fastvideo/pipelines/basic/stable_audio/stages/denoising.py
fastvideo.pipelines.basic.stable_audio.stages.StableAudioLatentPreparationStage ¶
StableAudioLatentPreparationStage(io_channels: int = 64, sample_size: int = 2097152, vae=None, sample_rate: int = 44100, audio_channels: int = 2)
Bases: PipelineStage