Constarium
← Search

Imaging · dataset · 2022

Mel spectrograms of sampled music

Listed in Hugging Face Datasets

Description

30,000 256x256 mel spectrograms of 5 second samples that have been used in music, sourced from WhoSampled and YouTube. The code to convert from audio to spectrogram and vice versa can be found in github.com/teticio/audio-diffusion along with scripts to train and run inference using De-noising Diffusion Probabilistic Models. x_res = 256 y_res = 256 sample_rate = 22050 n_fft = 2048 hop_length = 512

Links

Catalogue records · 1

Topics

Stated by source
audio · image · image to image · text
Provenance · 1 source records, 12 field assertions
SourceKeyLast seenRaw
Hugging Face Datasetsteticio/audio-diffusion-breaks-25611 d agoJSON v1
FieldAssertionExtractorEvidence
access_levelsource · Hugging Faceconnector:huggingface@1.0.0/gated
concepts[field].local:field:computer-science-aimapping · Hugging Faceconnector:huggingface@1.0.0
concepts[modality].hf_modality:audiosource · Hugging Faceconnector:huggingface@1.0.0
concepts[modality].hf_modality:imagesource · Hugging Faceconnector:huggingface@1.0.0
concepts[modality].hf_modality:textsource · Hugging Faceconnector:huggingface@1.0.0
concepts[modality].local:modality:audiomapping · Hugging Facevocabulary-mapper@1.0.0keywords['audio']
concepts[task].hf_task:image-to-imagesource · Hugging Faceconnector:huggingface@1.0.0/tags[task_categories:*]
created_datesource · Hugging Faceconnector:huggingface@1.0.0
descriptionsource · Hugging Faceconnector:huggingface@1.0.0/description
publication_datesource · Hugging Faceconnector:huggingface@1.0.0
titlesource · Hugging Faceconnector:huggingface@1.0.0/id
updated_datesource · Hugging Faceconnector:huggingface@1.0.0