Costruirò un'AI di speech to text in arabo con un modello finemente regolato

Alcune informazioni sono state tradotte automaticamente.

Egitto

Parlo Inglese, Arabo

Ingegnere AI

Ciao! Sono un ingegnere AI dall'Egitto con una laurea in AI & Data Science e una ricerca di visione artificiale come primo autore sotto peer review. Costruisco strumenti pratici di AI per aziende: cha...
Informazioni su questo servizio

Hai bisogno che l'audio in arabo venga trasformato automaticamente in testo? Creo pipeline di speech-to-text usando Whisper, il modello open-source di riconoscimento vocale, configurato per trascrivere le tue registrazioni in arabo in testo pulito e sottotitoli SRT temporizzati.


Ho perfezionato Whisper su 25.000 campioni di speech in arabo, riducendo il tasso di errore delle parole dal 44,5% al 25,7%, e ho creato un sistema completo che trascrive, riassume e cerca nell'audio arabo. Porto questa esperienza alle tue registrazioni, siano esse lezioni, interviste, podcast o riunioni.


Il pacchetto starter fornisce una pipeline di trascrizione pronta all'uso, testata su fino a 1 ora di audio, con output di testo e SRT e una guida all'installazione. Ricorda che questa è una trascrizione AI e non viene corretta da una persona; la precisione dipende dal dialetto, dal rumore di fondo e dalla qualità della registrazione. È disponibile come offerta personalizzata il fine-tuning di un modello sul tuo audio per una maggiore precisione.


Contattami prima di ordinare e inviami un breve campione del tuo audio, così posso valutarlo e stabilire aspettative chiare prima che tu acquisti.


Expertise:

Discorso e audio

Linguaggio di programmazione:

Python

Strumenti:

Altro

Il mio portfolio

Altri servizi della categoria Data science e ML offerti da me