Уровень 0 · материалов: 3
В кластер входят документы о технической реализации и программном внедрении функций распознавания речи, но не входят общие инструкции по использованию готовых функций пользовательских интерфейсов.
Общие признаки: преобразование речи в текст, использование API и сервисов распознавания, технические методы транскрибации
Группа выше: Распознавание и синтез речи
Смысл: The main idea is to provide a technical workaround for transcribing audio files using free tools by rerouting system audio to act as a microphone input for Google Translate or Google Docs.
Use VB-CABLE Virtual Audio Device to route audio files as microphone input, allowing Google Translate to transcribe them into text.
Смысл: The main idea is to demonstrate a practical method for .NET developers to implement speech recognition by sending audio files to Google's internal Chrome speech API.
A technical tutorial on using C# to send FLAC audio data to the Google Voice Search API for speech-to-text conversion.
Смысл: The main idea is to demonstrate a practical method for integrating a low-power microcontroller with a powerful cloud-based speech recognition service to create voice-controlled applications, such as smart home devices.
A technical walkthrough on using an STM32F4-Discovery board and a Wi-Fi module to capture audio, encode it with Speex, and recognize speech via the Google Speech API.