Costruirò un'AI di speech to text in arabo con un modello finemente regolato
Ingegnere AI
Informazioni su questo servizio
Hai bisogno che l'audio in arabo venga trasformato automaticamente in testo? Creo pipeline di speech-to-text usando Whisper, il modello open-source di riconoscimento vocale, configurato per trascrivere le tue registrazioni in arabo in testo pulito e sottotitoli SRT temporizzati.
Ho perfezionato Whisper su 25.000 campioni di speech in arabo, riducendo il tasso di errore delle parole dal 44,5% al 25,7%, e ho creato un sistema completo che trascrive, riassume e cerca nell'audio arabo. Porto questa esperienza alle tue registrazioni, siano esse lezioni, interviste, podcast o riunioni.
Il pacchetto starter fornisce una pipeline di trascrizione pronta all'uso, testata su fino a 1 ora di audio, con output di testo e SRT e una guida all'installazione. Ricorda che questa è una trascrizione AI e non viene corretta da una persona; la precisione dipende dal dialetto, dal rumore di fondo e dalla qualità della registrazione. È disponibile come offerta personalizzata il fine-tuning di un modello sul tuo audio per una maggiore precisione.
Contattami prima di ordinare e inviami un breve campione del tuo audio, così posso valutarlo e stabilire aspettative chiare prima che tu acquisti.
Expertise:
Discorso e audio
Linguaggio di programmazione:
Python
Strumenti:
Altro

