hand_landmarks_single_hand.py

# Este trabalho está licenciado sob a licença MIT.
# Copyright (c) 2013-2025 OpenMV LLC. Todos os direitos reservados.
# https://github.com/openmv/openmv/blob/master/LICENSE
#
# Este exemplo demonstra o modelo MediaPipe Hand Landmarks Detection do Google para uma única mão.
#
# NOTA: Este exemplo requer uma OpenMV Cam com NPU, como a AE3 ou N6, para executar em tempo real.

import csi
import time
import ml
from ml.preprocessing import Normalization
from ml.postprocessing.mediapipe import BlazePalm
from ml.postprocessing.mediapipe import HandLandmarks

# Inicializa o sensor.
csi0 = csi.CSI()
csi0.reset()
csi0.pixformat(csi.RGB565)
csi0.framesize(csi.VGA)

# BlazePalm requer uma imagem quadrada para melhores resultados.
# HandLandmarks funciona com imagens não quadradas provenientes de recortes do BlazePalm.
csi0.window((400, 400))

# Carrega o modelo integrado de detecção de palma
palm_detection = ml.Model("/rom/palm_detection_full_192.tflite", postprocess=BlazePalm(threshold=0.4))
print(palm_detection)

# Carrega o modelo integrado de pontos de referência da mão
hand_landmarks = ml.Model("/rom/hand_landmarks_full_224.tflite", postprocess=HandLandmarks(threshold=0.4))
print(hand_landmarks)

# Conexões de linhas entre as articulações da mão para desenhar o esqueleto da mão.
hand_lines = ((0, 1), (1, 2), (2, 3), (3, 4), (0, 5), (5, 6), (6, 7), (7, 8),
              (5, 9), (9, 10), (10, 11), (11, 12), (9, 13), (13, 14), (14, 15), (15, 16),
              (13, 17), (17, 18), (18, 19), (19, 20), (0, 17))

# Variáveis de rastreamento.
n = None

clock = time.clock()
while True:
    clock.tick()
    img = csi0.snapshot()

    if n is None:
        # palms é uma lista de tuplas ((x, y, w, h), score, keypoints)
        for r, score, keypoints in palm_detection.predict([img]):
            # rect é (x, y, w, h) - amplie em 3x para o modelo de pontos de referência da mão
            wider_rect = (r[0] - r[2], r[1] - r[3], r[2] * 3, r[3] * 3)
            # Opera apenas na ROI da palma detectada
            n = Normalization(roi=wider_rect)

    else:
        # hands é uma lista de tuplas ((x, y, w, h), score, keypoints)
        # índice 0 (se presente) é a mão esquerda
        # índice 1 (se presente) é a mão direita
        hands = hand_landmarks.predict([n(img)])

        # Nenhuma mão detectada; redefine o rastreador.
        if not hands:
            n = None
            continue

        # Desenha caixas delimitadoras ao redor das mãos detectadas e dos pontos-chave.
        for i, detections in enumerate(hands):
            for r, score, keypoints in detections:
                ml.utils.draw_predictions(img, [r], ("right",) if i else ("left",), ((0, 0, 255),), format=None)

                # keypoints: ndarray (21, 3) das articulações da mão (x, y, z)
                # Os índices seguem a convenção do MediaPipe:
                # 0: pulso
                # Polegar: 1 cmc, 2 mcp, 3 ip, 4 ponta
                # Indicador: 5 mcp, 6 pip, 7 dip, 8 ponta
                # Médio: 9 mcp, 10 pip, 11 dip, 12 ponta
                # Anelar: 13 mcp, 14 pip, 15 dip, 16 ponta
                # Mínimo: 17 mcp, 18 pip, 19 dip, 20 ponta
                # (cmc=base, mcp=nó dos dedos, pip=meio, dip=distal, ip=articulação do polegar, tip=ponta do dedo)
                ml.utils.draw_skeleton(img, keypoints, hand_lines, kp_color=(255, 0, 0), line_color=(0, 255, 0))

                # Centraliza new_wider_rect na mão para rastreamento
                new_wider_rect = (r[0] + (r[2] // 2) - (wider_rect[2] // 2),
                                  r[1] + (r[3] // 2) - (wider_rect[3] // 2),
                                  wider_rect[2],
                                  wider_rect[3])
                # Opera apenas na ROI da mão detectada
                n = Normalization(roi=new_wider_rect)

    print(clock.fps(), "fps")

results matching ""

    No results matching ""