Speech recognition
Speech recognition is the computational conversion of spoken language into written text or structured output. It infers linguistic content from an audio signal, often despite variation in speakers, accents, and recording conditions.