Costruirò riconoscimento facciale, riconoscimento dei gesti della mano e riconoscimento vocale o del parlato
Computer Vision, AI Developer, BIM Automation Specialist
Livello 1
Ha soddisfatto determinati criteri di prestazione e mostra un forte potenziale nel marketplace.
Informazioni su questo servizio
Hai bisogno di un sistema AI che possa riconoscere i volti, capire i segnali delle mani o elaborare la voce e i suoni in tempo reale?
Costruisco sistemi di riconoscimento multimodale AI personalizzati che combinano computer vision e elaborazione audio in base alla tua applicazione specifica.
In base alle tue esigenze, posso sviluppare:
- Riconoscimento, identificazione e verifica del volto
- Riconoscimento dei segnali e dei gesti della mano
- Riconoscimento della lingua dei segni
- Analisi di punti di riferimento di mani e dita
- Riconoscimento del parlato e della voce
- Riconoscimento di eventi sonori personalizzati
- Elaborazione in tempo reale di webcam e microfono/audio
- API di riconoscimento e integrazione con applicazioni
Il tuo sistema può elaborare input da webcam o video insieme a input da microfono/audio e restituire risultati di riconoscimento, classificazioni, eventi, coordinate, punteggi di fiducia o altri output necessari per la tua applicazione.
Per la computer vision, posso lavorare con tecnologie come Python, OpenCV, MediaPipe, YOLO, PyTorch, TensorFlow, ONNX Runtime, InsightFace e framework correlati.
Questo può essere usato per applicazioni interattive, strumenti di accessibilità, interfacce intelligenti, sistemi di sicurezza, progetti di lingua dei segni.
Linguaggio di programmazione:
Python
•
R
•
SQL
•
Java
•
NoSQL
Framework:
Scikit-learn
•
Google ML Kit
•
SimpleCV
•
keras
•
Panda

