Datasets

Datasets, corpora and benchmarks for music and audio AI.

98 listings

A turquoise atlas field connects tools and organizations around one orange coordinate.

98 results

ACE-KiSing
Scaled singing dataset introduced with ACE-Opencpop for multi-singer voice synthesis research.
Beijing, Mainland China, China
ACE-Opencpop
Scaled multi-singer Mandarin singing dataset introduced for large-scale singing-voice synthesis.
Beijing, Mainland China, China
AcousticBrainz
Crowdsourced low- and high-level acoustic descriptors indexed by MusicBrainz recording identifiers.
Spain
AcousticBrainz Genre Dataset
Four genre-annotation datasets joining AcousticBrainz features with AllMusic, Discogs, Last.fm and Tagtraum labels.
Spain
AI Music Tools
Russian-language directory and practical resource for AI music, audio, DAW, analysis, conversion, rhyme, and prompt tools.
Russian-speaking market (operator location unverified)
AudioCaps
Crowdsourced natural-language captions paired with AudioSet-derived audio clips.
South Korea
AudioSet
Human-labeled ten-second YouTube segments spanning music, speech and environmental sound classes.
United States
Bach Doodle Dataset
User-entered melodies and model-generated four-voice harmonizations contributed through the 2019 Bach Doodle.
United States
BAM! Artiestenmonitor
Annual artist survey from BAM! Popauteurs and academic collaborators covering income, working conditions, and generative-AI use and concern.
Netherlands
Brazilian Music Time-Series Dataset
Conjunto de Dados de Séries Temporais de Músicas Brasileiras
Dataset combining Spotify-derived acoustic features and processed lyrics for approximately 51,000 Brazilian tracks.
Belo Horizonte, Brazil