MuseControlLite: Multifunctional Music Generation with Lightweight Conditioners [ICML 2025]
-
Updated
Jan 6, 2026 - Python
MuseControlLite: Multifunctional Music Generation with Lightweight Conditioners [ICML 2025]
A desktop app to fine-tune, generate and perform live music with diffusion models. Runs on MacOS, Windows and Linux.
Music -- separate into stems, modify, convert to midi, add synth sounds, remix.
Portable offline AI audio studio with web UI & local API – XTTS, Fish Speech, Kokoro, Stable Audio, ACE-Step, voice cloning, music gen (no install)
Local Windows app for Stable Audio Open 1.0 - 9-language UI, multilingual prompt translation, 217 presets across 15 | categories, multi-variations, batch mode, game-ready WAV output. One-file installer.
Full-pipeline radio drama / audiobook production. Dialogue (Qwen3-TTS) + music (ACE) + SFX (MMAudio/SAO/ACE) + sidechain mix in one command.
Self-hosted audio API in one Docker container. Stem separation, mastering, MIR (BPM/key/chords), audio→MIDI, text-to-music + SFX (MusicGen/Stable Audio/Riffusion/AudioLDM2), diarization, speech enhancement, restoration, embeddings + zero-shot tagging, workflows, async + webhooks. REST + MCP. CPU + CUDA.
Automate radio drama and audiobook production with this pipeline. Convert JSON scripts into mixed, mastered audio files using multi-model AI orchestration.
Species-conditioned birdcall generation with Stable Audio Open 1.0, benchmarked against BirdNET.
Fun experiments on audio embedding spaces (and more) in Stable Audio
Local text-to-SFX MCP server running Stable Audio Open 1.0
To associate your repository with the stable-audio-open topic, visit your repo's landing page and select "manage topics."