Instructions to use cvssp/audioldm with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Diffusers
How to use cvssp/audioldm with Diffusers:
pip install -U diffusers transformers accelerate
import torch from diffusers import DiffusionPipeline # switch to "mps" for apple devices pipe = DiffusionPipeline.from_pretrained("cvssp/audioldm", dtype=torch.bfloat16, device_map="cuda") prompt = "Astronaut in a jungle, cold color palette, muted colors, detailed, 8k" image = pipe(prompt).images[0] - Notebooks
- Google Colab
- Kaggle
Download vocoder/pytorch_model.bin from cvssp/audioldm: direct link, hf CLI and curl.
- Browser
- Download file 221 MB
-
https://huggingface.co/cvssp/audioldm/resolve/main/vocoder/pytorch_model.bin
- Command line
-
hf download hf://cvssp/audioldm/vocoder/pytorch_model.bin
-
curl -L -o pytorch_model.bin https://huggingface.co/cvssp/audioldm/resolve/main/vocoder/pytorch_model.bin
221 MB
- Xet hash:
- a3df04e3d1f57398a42edf6433f61c80863059c4fd6a96e0bf3129ee347bb245
- Size of remote file:
- 221 MB
- SHA256:
- f9fbefc2b31c85d1dabe98e53d09ac88039af411162a7e641040a9c2b5f62364
·
Xet efficiently stores Large Files inside Git, intelligently splitting files into unique chunks and accelerating uploads and downloads. More info.