Функция распознавания речи использует faster-whisper — оптимизированную сборку модели Whisper от OpenAI — чтобы превращать ваш голос в текст в реальном времени. Требуется Python 3.12 (лаунчер может установить его автоматически); для максимальной производительности поддерживается ускорение на NVIDIA GPU, а также есть режим работы на CPU.