Audio · Vocals Only · screenshot coming soon
Intended purpose
Audio · Vocals Only takesCOMFYTV_VIDEO (or demuxed audio path), runs a Demucs-style workflow, outputs isolated vocals as COMFYTV_AUDIO. Lip-sync, vocal replace, karaoke prep, etc.
⚠️ Current status: workflow dropdown scansworkflows/audio-vocal/(no shipped JSON yet). Run fails without backend. Planned:lum3on/ComfyUI_AudioToolsAudioStemSeparate. See roadmap.md.
When to use it (once shipped)
- Extract vocals from MV for IA2V / TTS alignment
- Process vocal stem in Audio Stage
- Pair with Background Only
Planned design
- Stage + workflow + ▶ Run + snapshot.
- Input:
upstream videos: [video], no text prompt. - Demucs stem → WAV →
COMFYTV_AUDIOURL.
Types
Parameters
workflow
workflows/audio-vocal/ (reserved, not shipped).
video
SourceCOMFYTV_VIDEO. Optional prior Demux · Audio Track.
Outputs (when implemented)
Step by step (today)
- Demucs separation not available yet.
- Need raw track: Demux · Audio Track (✅).
- Advanced: drop custom workflow in
audio-vocal/+ sidebar config.
Full guides (recommended reading)
This page covers one node only. For end-to-end workflows, multi-stage pipelines, type conversion, and design rationale, see the ComfyTV user guides on GitHub:
Repository and workflows
FAQ
Q: vs Demux?A: Demux copies whole track; Vocals Only AI-separates vocals from accompaniment. Q: Empty workflow list?
A: Expected — nothing shipped yet. Q: Models when shipped?
A: Demucs + ComfyUI_AudioTools; watch models.md.
Related nodes
- Background Only (pending)
- Demux · Audio Track (✅)
- Video Stage (IA2V)