Speech-to-Text
The conversion of speech into text so that other components can search, summarize, classify, or trigger a workflow. Final quality depends on ASR, but also on turn segmentation, speaker identification, normalization, and preservation of uncertainty. A transcript that appears fluent can still carry errors that alter later decisions.