micro_speech.py

# Este trabalho está licenciado sob a licença MIT.
# Copyright (c) 2024 OpenMV LLC. Todos os direitos reservados.
# https://github.com/openmv/openmv/blob/master/LICENSE
#
# O módulo MicroSpeech foi projetado para processamento de áudio em tempo real e reconhecimento de fala
# em plataformas de microcontrolador. Ele utiliza modelos pré-treinados para pré-processamento de áudio e
# reconhecimento de fala, otimizado especificamente para detectar palavras-chave como "Yes" e "No".
import time
from ml.apps import MicroSpeech


def callback(label, scores):
    print(f'\nHeard: "{label}" @{time.ticks_ms()}ms Scores: {scores}')


# Por padrão, o objeto MicroSpeech usa o pré-processador de áudio embutido (float) e o
# módulo micro speech para pré-processamento de áudio e reconhecimento de fala, respectivamente. O
# usuário pode substituir ambos passando dois modelos:
# MicroSpeech(preprocessor=ml.Model(...), micro_speech=ml.Model(...), labels=["label",...])
speech = MicroSpeech()

# Inicia o streaming de áudio e processa o áudio recebido para reconhecer comandos de voz.
# Se um callback for passado, listen() ficará em loop indefinidamente e chamará o callback quando uma palavra-chave
# for detectada. Alternativamente, `listen()` pode ser chamado com um timeout (em ms), e ele
# retorna se o timeout expirar antes de detectar uma palavra-chave.
speech.listen(callback=callback, threshold=0.70)

results matching ""

    No results matching ""