Temporal ConstructsInholland project on creative dialogue among humans, AI and digital heritage using small sustainable AI models.NL
Text-to-Audio Generation using Instruction-Tuned LLM and Latent Diffusion ModelResearch work examining audio generation, text-to-audio generation.Global
The Interpretation Gap in Text-to-Music Generation ModelsResearch work examining music generation, music retrieval.Global
Toward Universal Text-to-Music RetrievalResearch work examining evaluation benchmark, music retrieval.Global
TuneJury: An Open Metric for Improving Music Generation Preference AlignmentResearch work examining evaluation benchmark, music generation.Global
UniAudio: An Audio Foundation Model Toward Universal Audio GenerationResearch work examining audio generation, singing voice.Global
UPF-BMAT Chair on Artificial Intelligence and MusicCátedra UPF-BMAT en Inteligencia Artificial y MúsicaPublic-private chair researching interpretable, transparent and accessible AI for music and training sector professionals.Barcelona, Catalonia, Spain
Using Songs to Improve Kazakh Automatic Speech RecognitionLREC 2026 paper evaluating sung Kazakh data as a complementary source for low-resource ASR.Kazakhstan / Kazakh language
Video Soundtrack Generation by Aligning Emotions and Temporal BoundariesResearch paper introducing EMSYNC for emotion- and boundary-aligned symbolic soundtrack generation.Porto, Portugal
Video-based Music GenerationDoctoral work consolidating EMSYNC, video emotion classification and an emotion-labelled symbolic music dataset.Porto, Portugal
WavJourney: Compositional Audio Creation with Large Language ModelsResearch work examining audio generation, evaluation benchmark.Global
Whither Music?JKU research project examining AI, music creativity and changing musical practices.Linz, Austria