Hai una registrazione del dittafono — un atto dettato, un'intervista, note cliniche — e ti serve come testo. Esporta il file dal registratore, importalo in Whisper Notes e trascrivilo sul tuo iPhone o Mac con un modello on-device come Parakeet V3. L'audio non viene caricato, e non ci sono account né tariffe al minuto. Whisper Notes è offerto come acquisto una tantum; il prezzo attuale è indicato in ciascun canale di acquisto; la versione Mac include una prova gratuita di 10.000 parole.
Chi usa ancora il dittafono — e perché è importante
Il dittafono non è mai scomparso. Si è solo spostato nelle professioni in cui parlare è più veloce che scrivere — e in cui il contenuto è troppo sensibile per essere perso, o per trapelare.
- •Gli avvocati dettano atti, note di udienza e lettere tra un appuntamento e l'altro. Quelle registrazioni possono contenere nomi di clienti, strategia processuale e dettagli coperti da segreto professionale, soggetti a rigide politiche di riservatezza.
- •I medici dettano referti e lettere di invio dopo ogni paziente. Quelle registrazioni possono contenere informazioni sanitarie sensibili e richiedono una gestione attenta.
- •I giornalisti registrano le interviste con registratore vocale o telefono. La tutela delle fonti comincia dal non caricare la loro voce sul cloud di qualcun altro.
- •I ricercatori raccolgono ore di interviste e osservazioni sul campo, spesso sotto accordi etici che limitano esplicitamente dove le registrazioni possono essere elaborate.
Per tutti e quattro i gruppi il collo di bottiglia è lo stesso: trasformare ore di dettatura in testo. Una dattilografa, un servizio di trascrizione esterno o un servizio cloud introducono un'altra persona o un altro sistema nel flusso di lavoro. La trascrizione on-device mantiene la fase di elaborazione su hardware sotto il tuo controllo.
Dalla registrazione al testo in tre passaggi
1. Esporta il file dal dittafono
Collega il registratore vocale via USB (o usa la sua app companion) e copia la registrazione sul Mac o sull'iPhone. La maggior parte dei dittafoni digitali — Olympus, Philips, Sony, Zoom, o l'app Memo Vocali del telefono — salva le registrazioni in MP3, WAV o M4A. Tutti questi formati funzionano così come sono; nessuna conversione necessaria.
2. Importa in Whisper Notes
Trascina il file in Whisper Notes sul Mac, o condividilo con l'app su iPhone. Non c'è limite di durata — un memo di due minuti e un'intervista di tre ore vanno bene entrambi. Funzionano anche i file video: importa un MP4 o un MOV e l'app trascrive la traccia audio.
| Formato | Tipo | Supportato |
|---|---|---|
| MP3 | Audio — la maggior parte dei dittafoni digitali | Sì, qualsiasi durata |
| WAV | Audio — registratori non compressi | Sì, qualsiasi durata |
| M4A | Audio — Memo Vocali su iPhone | Sì, qualsiasi durata |
| MP4 | Video — viene trascritta la traccia audio | Sì, qualsiasi durata |
| MOV | Video — viene trascritta la traccia audio | Sì, qualsiasi durata |
3. Trascrivi in locale, esporta ovunque
Avvia la trascrizione. Su Mac, Parakeet V3 è il modello predefinito e gira interamente sul dispositivo. Nel nostro test su M4 Pro ha trascritto lo stesso file di 35 minuti in 18 secondi, contro i 3 minuti di Whisper Large V3 Turbo. Il suo 6,32% di WER in inglese viene dall'Open ASR Leaderboard, non da ogni possibile registrazione da dittafono: il tuo risultato varierà con la lingua, il microfono, il rumore di fondo e il vocabolario specialistico.
Una registrazione importata, trascritta con timestamp — clicca su un segmento per ascoltare l'audio originale
Quando hai finito, esporta in TXT per un documento, oppure in SRT/VTT con timestamp se la registrazione proviene da un video. Se vuoi, correggi prima il testo direttamente inline — le correzioni restano sincronizzate con l'audio.
Perché offline batte il cloud per la dettatura
I servizi di trascrizione cloud in genere caricano l'audio sull'infrastruttura del fornitore e lo gestiscono secondo le proprie politiche di conservazione e trattamento dei dati. Per alcune registrazioni può andare bene, ma aggiunge un ulteriore soggetto da valutare quando l'audio contiene informazioni riservate su clienti, pazienti, fonti o ricerche.
Whisper Notes scarica il modello vocale selezionato durante la configurazione; da quel momento registrazione e trascrizione possono funzionare senza connessione a internet. L'audio e la trascrizione non vengono caricati per la trascrizione. Questo può ridurre l'esposizione dei dati a terzi, ma l'elaborazione locale da sola non rende conforme un flusso di lavoro legale, medico o di ricerca: contano ancora la sicurezza del dispositivo, il processo di consenso, la politica di conservazione e i tuoi obblighi professionali.
| App offline (Whisper Notes) | Servizi di trascrizione cloud | |
|---|---|---|
| Dove viene elaborato l'audio | Sul tuo dispositivo | Sui server del fornitore |
| Riservatezza | L'audio non lascia mai il dispositivo | Dipende dalle politiche del fornitore |
| Trasferimento a terzi durante la trascrizione | Nessuno dopo la configurazione del modello | Dipende dal fornitore e dal piano |
| Costo | acquisto una tantum; prezzo indicato nel canale di acquisto | Abbonamento mensile o tariffe al minuto |
| Funziona senza internet | Sì, dopo la configurazione del modello | No |
| Account obbligatorio | No | Sì |
Anche i conti tornano, per chi detta molto. Se detti un'ora al giorno, le tariffe al minuto del cloud si accumulano in fretta, e l'abbonamento si paga sia che tu detti sia che non lo faccia. Un acquisto una tantum costa lo stesso, che tu trascriva dieci minuti al mese o dieci ore alla settimana.
Come ottenere la trascrizione più accurata
Due impostazioni fanno la differenza più grande nella dettatura professionale:
Vocabolario personalizzato. I modelli vocali generalisti possono sbagliare proprio le parole che contano di più nel tuo settore — cognomi di clienti, nomi di farmaci, riferimenti normativi, gergo tecnico. Whisper Notes ti permette di aggiungere i nomi e i termini ricorrenti a un vocabolario personalizzato, così il motore di trascrizione ha più contesto. Verifica sempre nomi, dosaggi, cifre e citazioni sull'audio prima di fare affidamento sulla trascrizione.
Il modello giusto per la tua lingua. Scegli il modello che corrisponde alla lingua in cui detti:
| Italiano / lingue europee | Parakeet V3 — 25 lingue europee, tra cui l'italiano; 35 minuti in 18 secondi nel nostro test su M4 Pro; 6,32% di WER in inglese sull'Open ASR Leaderboard; 465 MB di download |
| Cinese / giapponese / coreano | SenseVoice — progettato per cinese, giapponese, coreano e cantonese; 27 minuti di cinese in 13,83 secondi nel nostro test su M4 Pro |
| Altre lingue | Whisper Large V3 Turbo — oltre 100 lingue, circa 1,6 GB, la copertura linguistica più ampia dei tre |
E un'abitudine dell'era della dettatura analogica paga ancora: tieni il registratore vicino, parla a ritmo costante e detta frasi complete e ben scandite. Audio pulito in ingresso, testo pulito in uscita.
Domande frequenti
Posso trascrivere vecchie registrazioni del dittafono?
Sì. Copia i file dal registratore e importali in Whisper Notes — MP3, WAV e M4A funzionano tutti, di qualsiasi durata. Una registrazione di dieci anni fa si trascrive esattamente come una di stamattina; l'accuratezza dipende dalla qualità dell'audio, non dall'età del file.
Qual è la migliore app per trascrivere le registrazioni del dittafono?
Valuta ogni app su quattro criteri: dove viene elaborato l'audio, quali formati di file accetta, se supporta i tuoi termini specialistici e quanto costa in un anno. Whisper Notes offre trascrizione on-device, import di MP3/WAV/M4A/MP4/MOV di qualsiasi durata, vocabolario personalizzato e un acquisto una tantum al prezzo indicato nel canale di acquisto. La versione Mac include una prova gratuita di 10.000 parole.
La trascrizione del dittafono funziona senza internet?
Sì. Scarica il modello vocale scelto durante la configurazione; da quel momento la trascrizione gira sul tuo iPhone o Mac senza connessione a internet e la registrazione non viene caricata.
Quanto è accurata la trascrizione offline delle registrazioni del dittafono?
L'Open ASR Leaderboard riporta per Parakeet V3 un WER del 6,32% in inglese, ma quel benchmark non è una garanzia per una registrazione specifica. Accento, distanza dal microfono, rumore di fondo e termini specialistici influenzano tutti l'accuratezza. Il vocabolario personalizzato può dare contesto per nomi e gergo ricorrenti; verifica i dettagli critici sull'audio.