Skip to main content
Audio · Vocals Only

Audio · Vocals Only · screenshot coming soon

Intended purpose

Audio · Vocals Only takes COMFYTV_VIDEO (or demuxed audio path), runs a Demucs-style workflow, outputs isolated vocals as COMFYTV_AUDIO. Lip-sync, vocal replace, karaoke prep, etc.
⚠️ Current status: workflow dropdown scans workflows/audio-vocal/ (no shipped JSON yet). Run fails without backend. Planned: lum3on/ComfyUI_AudioTools AudioStemSeparate. See roadmap.md.

When to use it (once shipped)

  • Extract vocals from MV for IA2V / TTS alignment
  • Process vocal stem in Audio Stage
  • Pair with Background Only

Planned design

  • Stage + workflow + ▶ Run + snapshot.
  • Input: upstream videos: [video], no text prompt.
  • Demucs stem → WAV → COMFYTV_AUDIO URL.

Types

Parameters

workflow

workflows/audio-vocal/ (reserved, not shipped).

video

Source COMFYTV_VIDEO. Optional prior Demux · Audio Track.

Outputs (when implemented)

Step by step (today)

  1. Demucs separation not available yet.
  2. Need raw track: Demux · Audio Track (✅).
  3. Advanced: drop custom workflow in audio-vocal/ + sidebar config.
This page covers one node only. For end-to-end workflows, multi-stage pipelines, type conversion, and design rationale, see the ComfyTV user guides on GitHub:

Repository and workflows

FAQ

Q: vs Demux?
A: Demux copies whole track; Vocals Only AI-separates vocals from accompaniment.
Q: Empty workflow list?
A: Expected — nothing shipped yet.
Q: Models when shipped?
A: Demucs + ComfyUI_AudioTools; watch models.md.
  • Background Only (pending)
  • Demux · Audio Track (✅)
  • Video Stage (IA2V)