Une API de reconnaissance vocale ou audio est un service en ligne qui transforme la voix ou les sons captés par un micro en texte compréhensible par une application. Par exemple, Google Speech-to-Text ou Microsoft Azure Speech transcrivent des commandes vocales, des messages ou des dictées. Pour l'utiliser dans une webapp en 2026, il suffit d'intégrer l'API via une bibliothèque JavaScript ou des requêtes HTTP. On active le micro du navigateur avec la Web Speech API ou par WebRTC, on envoie le flux audio à l'API, et on reçoit le texte transcrit en retour. Cette méthode permet d'ajouter facilement des commandes vocales ou des formulaires dictés sur un site, tout en respectant la confidentialité via des paramètres de sécurisation. Plus d'infos sur les documentations officielles de Google Cloud Speech-to-Text, Microsoft Azure Speech ou Mozilla DeepSpeech.