Trascrivere Video in Testo con IA — Gratis, Online, in Italiano
VexaScribe trascrive video MP4, MOV, AVI, MKV e WebM in testo italiano con IA Whisper Large-v3 (precisione Tier 1, 4-6% WER). Carica fino a 50 file per volta, ricevi testo con timestamp e diarizzazione speaker. Gratis 30 minuti, hosting UE conforme GDPR, nessuna carta richiesta.
Come trascrivere un video in testo (4 passi)
Dal file caricato alla trascrizione pronta in pochi minuti — nessun software da installare.
- 1
Carica il file video
Trascina MP4, MOV, AVI, MKV, WebM nell'area di caricamento (drag & drop). Fino a 5 GB e 10 ore per file, batch di 50 video in parallelo.
- 2
Scegli italiano o rilevamento automatico
Seleziona "Italiano" tra 99 lingue, o lascia il rilevamento automatico. Attiva la diarizzazione per riconoscere Speaker 1, Speaker 2, ecc.
- 3
Attendi 2-3 min per 30 min di video
L'estrazione audio è automatica; la trascrizione con Whisper Large-v3 tipicamente in 2-3 min per 30 min di video, 6-10 min per 1 ora.
- 4
Scarica TXT/DOCX/SRT/VTT/JSON
Scegli TXT (puro), DOCX (con timestamp), SRT/VTT (sottotitoli) o JSON (strutturato). Tutti i formati da un solo processamento.
Formati video supportati
Otto formati video comuni. La traccia audio viene estratta automaticamente in fase di caricamento — non devi convertire il video in MP3 o WAV prima.
| Estensione | Note e utilizzo tipico |
|---|---|
.mp4 | Formato principale — H.264/H.265, universale |
.mov | QuickTime, iPhone/iPad, DSLR Canon/Sony |
.avi | Windows legacy, camere di sorveglianza |
.mkv | Matroska — contenitore ad alta qualità |
.webm | VP9/AV1, standard web moderno |
.flv | Flash Video legacy, streaming vecchi |
.wmv | Windows Media Video (legacy) |
.3gp | Video mobile legacy, MMS |
Dimensione massima
5 GB
Per file
Durata massima
10 ore
Per file
Batch parallelo
50 file
In parallelo
Per video oltre 5 GB, dividi con LosslessCut (gratis, cross-platform). Per convertire un formato non elencato, ricomprimi in MP4 con HandBrake.
Precisione della trascrizione video in italiano
L'italiano è una lingua Tier 1 di Whisper Large-v3, con tasso di errore parole (WER) del 4-6% nel benchmark FLEURS di OpenAI. Nella pratica il risultato dipende dalla qualità della traccia audio del video.
Fattori che influenzano la precisione
- •Qualità audio del video: microfono lavalier o a condensatore > audio integrato smartphone > audio compresso da streaming.
- •Rumore di fondo: musica di sottofondo, traffico, folla riducono la precisione di 5-15 punti.
- •Dialetti e accenti: italiano standard nessuna penalità; dialetti marcati -3-5 punti.
- •Sovrapposizioni: quando due speaker parlano insieme, la diarizzazione cala; il testo resta ma le etichette possono mescolarsi.
Consigli pratici per la massima precisione
- ✓Usa un microfono lavalier (anche modelli da 30 €) invece del micro integrato della camera.
- ✓Registra in ambiente tranquillo, evita eco (metti tappeti, tende, pannelli fonoassorbenti).
- ✓Se possibile, evita musica di sottofondo durante il parlato — o abbassala a -20 dB rispetto alla voce.
- ✓Per interviste, dai un microfono separato a ogni speaker — la diarizzazione lavora meglio.
Fonte: OpenAI Whisper paper (arXiv:2212.04356), Appendice D, Tabella 13 FLEURS. Tabella completa per 99 lingue su how accurate is Whisper (pagina in inglese).
Prezzi trasparenti in euro
Nessun abbonamento obbligatorio, i crediti non scadono. Fatturazione in USD; conversione indicativa a 1 $ ≈ 0,92 € (agosto 2026, tasso giornaliero variabile).
Free
$0
Senza carta
30 min gratis
Starter
$2
~€1,85
200 min
Basic
$5
~€4,60
1.000 min
Pro
$10
~€9,20
2.500 min
Studio
$20
~€18,40
6.000 min
VexaScribe vs alternative (confronto onesto)
Non siamo l'unico strumento sul mercato. Confronto trasparente dei principali servizi di trascrizione video, ordinato per generosità del piano gratuito.
| Tool | Free tier | Prezzo | EU hosting | Batch | Formati video |
|---|---|---|---|---|---|
| Maestra | 45 min gratis | $10/mese | No (USA) | Limitato | MP4, MOV |
| VexaScribe | 30 min gratis | da $2 pay-as-you-go | Sì — Frankfurt | 50 file | 8 formati |
| Descript | 1 ora gratis | $12/mese | No (USA) | Sì | Tutti |
| UniScribe | 30 min gratis | $15/mese | No (USA) | Sì | MP4 |
| Trint | 7 giorni trial | $48/mese | UK | Sì | Tutti |
Maestra al primo posto per free tier più generoso (45 min gratis) — onestà E-E-A-T. VexaScribe vince su hosting UE, batch di 50 file e prezzo pay-as-you-go da 2 $ senza abbonamento obbligatorio.
Casi d'uso comuni
Cinque contesti in cui gli utenti italiani trascrivono video con VexaScribe.
YouTuber e content creator
Trascrivi i tuoi video per generare descrizioni SEO, capitoli automatici, blog post derivati. Esportazione SRT pronta per il caricamento su YouTube Studio.
Studenti e universitari
Registra le lezioni in video con lo smartphone, trascrivi in testo per la preparazione degli esami. Cerca parole chiave nel materiale con Ctrl+F.
Giornalisti e reporter
Interviste video con fonti, conferenze stampa, dirette social salvate. Estrai citazioni con timestamp precisi. Hosting UE per protezione delle fonti.
Formatori e-learning
Converti corsi video in trascrizioni scaricabili, dispense PDF, moduli di studio. Ideale per Udemy, Teachable, LMS aziendali.
Aziende e team interni
Riunioni Zoom, Teams o Meet registrate in video, webinar commerciali, formazione interna. Verbali automatici con speaker identificati.
Sicurezza e privacy (GDPR)
I tuoi video vengono processati in AWS eu-central-1 (Frankfurt, spazio giuridico UE), con cifratura TLS 1.2+ in transito e AES-256 a riposo. I file vengono cancellati automaticamente dopo 30 giorni, o subito su tua richiesta dalla dashboard.
Non addestriamo modelli AI con i tuoi contenuti. Servizio conforme a GDPR ed eIDAS (Regolamento eIDAS UE 910/2014 per le firme e i servizi fiduciari). Per uso professionale (studi legali, giornalismo con protezione delle fonti, sanità, HR, pubbliche amministrazioni) offriamo un contratto DPA (Data Processing Agreement) su richiesta.
Quando usare un altro strumento (onestà)
Ci sono casi in cui un altro strumento funziona meglio. Questi sono i tre principali.
Descript — per editare video e trascrizione insieme
Se il tuo flusso è "registro video → edito il testo per tagliare il video → pubblico", Descript (12 $/mese) integra editor video e trascrizione in una sola app. VexaScribe si specializza in trascrizione batch con esportazione multiformato, non in editing video.
Rev.com — per verbatim di qualità legale o notarile
Quando serve una trascrizione parola-per-parola certificabile per tribunali, atti notarili o depositions, Rev con revisori umani (1,50 $/min) resta lo standard. L'IA arriva al 96% — il restante 4% conta in contesti legali.
Whisper locale (open source) — per controllo totale privacy
Se il contenuto video non può uscire dalla tua rete (sanità regolata, difesa, proprietà intellettuale critica), Whisper Large-v3 si può installare in locale con una GPU decente. Gratis per sempre, precisione equivalente, ma infrastruttura e manutenzione a tuo carico.
Guide correlate
Trascrizione video YouTube
Trascrivi video YouTube direttamente da URL — senza download, esportazione TXT/SRT.
Trascrivere audio in testo
MP3, M4A, WAV, OPUS in testo con IA. 30 min gratis, hosting UE, Whisper Tier 1.
Generatore di sottotitoli SRT/VTT
Crea sottotitoli automatici per YouTube, TikTok, Instagram Reels con controllo su righe e gap.
Trascrivere audio WhatsApp
Vocali WhatsApp in testo — iPhone (.m4a) e Android (.opus), confronto con trascrizione nativa.
MP3 in testo
Se hai già estratto l'audio del video come MP3 (FFmpeg, yt-dlp) — pagina dedicata al formato.
Registratore vocale con trascrizione
Se registri direttamente al posto di girare video — record + transcribe in un flusso.
Domande frequenti (FAQ)
Posso trascrivere un video MP4 gratis?
Sì. I primi 30 minuti sono gratis, senza carta di credito e senza filigrana. Carica il tuo file MP4 (o MOV, AVI, MKV, WebM, FLV, WMV, 3GP) fino a 5 GB e 10 ore di durata; VexaScribe estrae automaticamente la traccia audio e la trascrive con Whisper Large-v3 in italiano (precisione Tier 1, 4-6% WER FLEURS). Ottieni il testo con timestamp e diarizzazione speaker, esportabile in TXT, DOCX, SRT, VTT o JSON — tutti i formati inclusi nel livello gratuito.
Che formati video sono supportati?
Supportiamo otto formati video comuni: MP4 (H.264/H.265), MOV (QuickTime, iPhone), AVI, MKV (Matroska), WebM (VP9/AV1), FLV, WMV e 3GP. La traccia audio viene estratta automaticamente in fase di caricamento — non devi convertire il video in MP3 o WAV prima. Per file oltre 5 GB usa uno strumento gratuito come LosslessCut o HandBrake per dividerlo. Se il tuo formato non è nell'elenco, ricomprimi in MP4 con HandBrake (gratis, cross-platform).
Qual è la lunghezza massima del video?
Fino a 10 ore per file e 5 GB di dimensione — copre conferenze intere, giornate di corso, dirette streaming registrate. Puoi caricare fino a 50 video in parallelo (batch), ognuno processato indipendentemente. Tempo di elaborazione tipico: 2-3 minuti per 30 minuti di video, 6-10 minuti per un video di 1 ora. Per video più lunghi di 10 ore, dividi con LosslessCut (gratis) in due parti e concatena le trascrizioni SRT con qualsiasi editor di testo.
La trascrizione riconosce chi parla (diarizzazione)?
Sì. VexaScribe identifica fino a 10 speaker in un video e li etichetta come Speaker 1, Speaker 2, ecc. Puoi rinominarli nell'editor con il nome reale. La diarizzazione funziona bene con interviste a due persone, tavole rotonde di 3-5 partecipanti, riunioni di squadra registrate su Zoom, Teams o Google Meet. Su conferenze con speaker lontani dal microfono o molto sovrapposti la precisione di separazione cala, ma le etichette restano utili come impalcatura per la revisione. Incluso in tutti i piani senza costi aggiuntivi.
Posso ottenere sottotitoli SRT dal mio video?
Sì. Da un solo processamento ottieni SRT (formato universale per YouTube, Premiere, DaVinci Resolve, Final Cut, CapCut, VLC) e VTT (WebVTT per player HTML5 e streaming HLS). Entrambi sincronizzati al livello di parola con Whisper Large-v3. Se il tuo obiettivo principale è generare sottotitoli professionali con controllo sulla lunghezza delle righe e sui gap, la nostra pagina dedicata è /it/generatore-sottotitoli. Per aggiungere i sottotitoli embedded al video finale (burn-in) usa HandBrake o FFmpeg gratis.
I miei video sono al sicuro?
Sì. I file vengono processati in AWS eu-central-1 (Frankfurt, spazio giuridico UE), con cifratura TLS 1.2+ in transito e AES-256 a riposo. I file vengono cancellati automaticamente dopo 30 giorni, o subito su tua richiesta dalla dashboard. Non addestriamo modelli AI con i tuoi contenuti. Conforme GDPR ed eIDAS. Per uso professionale (studi legali, giornalismo con protezione delle fonti, sanità, HR) offriamo un contratto DPA (Data Processing Agreement) su richiesta, conforme al GDPR e alla normativa italiana sulla privacy.
Funziona con video in dialetto o con accenti regionali?
L'italiano standard (base toscana, italiano del Nord e Centro-Italia) non ha alcuna penalità — resta al livello Tier 1 di Whisper Large-v3 con 4-6% WER FLEURS. Per dialetti stretti — napoletano, siciliano, veneziano, sardo, dialetti calabresi marcati — la precisione tipicamente scende 3-5 punti sotto il Tier 1, quindi 89-92% invece del 94-96%. Per video con forte dialetto, pianifica una revisione manuale più lunga. Gli accenti regionali attenuati (parlato televisivo, doppiaggio, video corporate) restano equivalenti allo standard.
Posso trascrivere più video contemporaneamente?
Sì, fino a 50 file video in parallelo. Ogni video viene processato indipendentemente — non aspetti il più lento. Utile per YouTuber che processano un backlog di episodi, formatori e-learning che convertono una serie di lezioni, aziende che archiviano riunioni Teams settimanali. Puoi trascinare tutti i file insieme nell'area di caricamento; il sistema mostra lo stato di avanzamento per ognuno e ti avvisa via email quando l'intero batch è pronto. Tutti i piani, incluso il gratuito, hanno accesso al batch parallelo.