Strumento File

Strumento di trascrizione audio e video in testo

Seleziona un file audio o video e crea una trascrizione testuale in locale, senza caricare la registrazione.

Funziona nel browser. Nessun caricamento.

Funziona nel browser. Nessun caricamento.

Per file multimediali lunghi o ad alta risoluzione, si consiglia l'uso di un computer desktop o portatile. Mantieni aperta questa scheda; velocità, memoria e batteria dipendono dal tuo dispositivo.

Al primo utilizzo vengono scaricati circa 58 MB relativi al modello e al motore locale. La registrazione non viene caricata; il browser potrebbe scaricarla nuovamente se la cache viene svuotata.

Funziona nel browser. Nessun caricamento.

Informazioni su questo strumento

Strumento di trascrizione audio e video in testo reso semplice.

Il riconoscimento vocale viene eseguito localmente nel browser utilizzando il modello multilingue Whisper Tiny. Al primo utilizzo, il browser scarica circa 43 MB di file del modello open source da Hugging Face; la registrazione stessa non viene mai inviata a tale piattaforma né a UsefulVerse. Il browser potrebbe memorizzare il modello nella cache per utilizzi successivi, ma è possibile cancellare tale cache. Poiché il modello è di dimensioni ridotte, si consiglia di controllare nomi, numeri e punteggiatura per individuare eventuali errori. Non sono previsti limiti fissi di dimensione del file o di durata della registrazione lato server; i limiti pratici dipendono dal dispositivo, dal browser, dalla memoria, dai codec multimediali supportati, dalla batteria e dallo spazio di archiviazione disponibile. Per registrazioni lunghe o ad alta risoluzione è vivamente consigliato l'uso di un computer desktop o portatile. Per scaricare il modello la prima volta è necessaria una connessione a Internet.

Domande frequenti

Informazioni su Strumento di trascrizione audio e video in testo.

Come posso trascrivere un file audio o video in testo?

Scegli una registrazione o un video con traccia audio, seleziona la lingua parlata (o l'opzione di rilevamento automatico) e avvia la trascrizione. Il riconoscimento vocale avviene sul tuo dispositivo.

La mia registrazione viene caricata per la trascrizione?

No. Il file multimediale viene decodificato e trascritto all'interno del browser. Al primo utilizzo vengono scaricati circa 58 MB di file relativi al modello e al motore locale; il browser potrebbe scaricarli nuovamente se la cache viene svuotata.

Quanto è precisa la trascrizione?

Il modello multilingue compatto potrebbe interpretare erroneamente nomi, numeri e punteggiatura. Controlla la trascrizione prima di utilizzarla o condividerla.