Il blog di Transcribe Labs
Come testiamo la qualità delle trascrizioni e cosa abbiamo scoperto.
Da dove iniziare
- Perché un solo motore non basta: più motori aiutano solo se sbagliano in modo diverso
- Gli errori di trascrizione più pericolosi si leggono benissimo
- Il WER mente. Ecco come misuriamo la precisione sulle interviste reali
- Chi l'ha detto? Attribuire i parlanti quando parlano in tanti
- Appunti sul campo da 27 lingue: come abbiamo scelto i motori per ciascuna
Per argomento
Come misuriamo l'accuratezza
Lingue miste
27 lingue, una per una
Tutti gli articoli
Perché un solo motore non basta: più motori aiutano solo se sbagliano in modo diverso
Un motore sbaglia sistematicamente nomi e numeri. Più motori aiutano solo se sbagliano in punti diversi. Un'intervista reale, compreso dove abbiamo perso.
Continua a leggereGli errori di trascrizione più pericolosi si leggono benissimo
Una negazione ribaltata si legge benissimo e un voto a maggioranza non la scopre. Gli strumenti dovrebbero dire dove sono incerti: ne abbiamo verificati 15.
Continua a leggereIl WER mente. Ecco come misuriamo la precisione sulle interviste reali
La metrica d'errore preferita dal settore inganna sulle interviste. Noi prima verifichiamo il riferimento, poi contiamo gli errori che cambiano il senso.
Continua a leggereQuando le interviste cambiano lingua
Intervistato spagnolo, ricercatore cinese, interprete in mezzo. Documentazione e test di laboratorio ci hanno sviato; un audio reale ha detto il contrario.
Continua a leggereChi l'ha detto? Attribuire i parlanti quando parlano in tanti
Le etichette dei parlanti integrate slittano con più persone. Imparare prima ogni voce ci ha portato oltre il 99% su dati pubblici, se si parla a turno.
Continua a leggereAppunti sul campo da 27 lingue: come abbiamo scelto i motori per ciascuna
Nessun motore è il migliore ovunque. L'indice dei nostri test lingua per lingua: quali motori abbiamo scelto per ciascuna delle 27 lingue, e perché.
Continua a leggere