Qwen3-ForcedAligner
·
word-level timestamps
connecting…
Audio (wav/mp3/flac, ≤ 400 s)
drop a file or click to choose
Model
Language
Transcript
— leave empty to auto-transcribe with Whisper large-v3
Align
Karaoke
⟲ replay
⬇ json
table
#
word
start (s)
end (s)
dur (ms)