Riconoscimento vocale gratuito per il giapponese
Carica il tuo audio o video in giapponese e ottieni in pochi minuti una trascrizione precisa e modificabile — automatica, nel browser e gratuita per iniziare.
Il giapponese è parlato da circa 125 milioni di persone, quasi tutte in Giappone, ed è la lingua di una delle più grandi economie al mondo per media, business e ricerca. Interviste, lezioni, consigli di amministrazione e contenuti video in giapponese vengono registrati di continuo, e prima o poi quasi tutto questo materiale deve diventare testo consultabile.
Il giapponese chiede inoltre a un motore di riconoscimento vocale qualcosa che quasi nessun'altra lingua richiede: si scrive con tre sistemi di scrittura contemporaneamente, intrecciati all'interno di una sola frase. I kanji portano le parole di contenuto, gli hiragana la grammatica e le flessioni, i katakana i prestiti, i nomi stranieri e le onomatopee. Scegliere tra loro non è una preferenza di formattazione: è la trascrizione stessa. Le stesse sillabe pronunciate «kami» sono 紙 per la carta, 神 per una divinità e 髪 per i capelli: identiche nell'aria, tre caratteri diversi sulla pagina, e solo la frase circostante decide quale sia quello giusto. Nell'esempio qui sotto puoi vedere il fenomeno all'opera: ゴム, la parola per gomma che il giapponese ha preso in prestito dall'olandese, è correttamente scritta in katakana, mentre 西洋人 e 手拭 nello stesso brano sono in kanji e le particelle attorno a loro in hiragana.
A questo si aggiunge che il giapponese scritto non mette spazi tra le parole. Un motore non può limitarsi a mettere per iscritto i suoni e lasciare che sia la spaziatura a fare il resto: deve decidere dove finisce ciascuna parola, perché non c'è alcun confine visibile su cui appoggiarsi. Nemmeno la punteggiatura viene pronunciata, quindi le 、 e i 。 di una trascrizione sono dedotti dal fraseggio invece che uditi. Il giapponese parlato si affida in parte all'accento tonale: 箸 (le bacchette), 橋 (il ponte) e 端 (il bordo) sono tutti «hashi» e nella pronuncia di Tokyo si distinguono da dove cade il tono. Contare aggiunge un altro livello, perché il giapponese conta le cose con un classificatore che cambia forma insieme al numero: tre oggetti lunghi sono 三本 (sanbon) ma sei sono 六本 (roppon), mentre le cose piatte prendono 枚 e i piccoli animali 匹.
La cortesia è grammaticale e non ornamentale. Passare dal registro colloquiale al keigo non addolcisce un verbo: lo sostituisce. 見る diventa ご覧になる quando è l'interlocutore a guardare e 拝見する quando è chi parla, e 言う diventa おっしゃる o 申す nello stesso modo. Una trascrizione che sbaglia su questo non si limita a suonare strana: riferisce il registro sociale sbagliato. Carica il tuo audio o video e il motore mette per iscritto il giapponese parlato come testo pulito e consultabile, con i tre sistemi di scrittura mescolati come li mescolerebbe chi scrive in giapponese. Funziona nel browser, non richiede installazione, e i primi minuti sono gratuiti senza bisogno di un account.
Per cosa si trascrive giapponese
Business e riunioni
Tieni verbali scritti di riunioni e chiamate in giapponese, così decisioni e azioni da svolgere restano fissate in un testo che puoi cercare.
Media e creator
Genera sottotitoli e show notes in giapponese direttamente dall'audio del tuo video o podcast, in kanji e kana corretti.
Ricerca e studio
Converti lezioni e interviste sul campo in giapponese in testo consultabile da citare e su cui studiare.
Che aspetto ha davvero una trascrizione in giapponese
Questa è una registrazione reale di 45 secondi, letta da una persona in carne e ossa e passata attraverso il nostro motore IA esattamente come faresti con il tuo file. Dopo non è stato corretto nulla. Premi play e leggi insieme all'audio.
motore IA, 20 secondi di elaborazione
- 00:00私のじっとしている間にだいぶ多くの男が塩を浴びに出て来たが、いずれも胴と腕と股は出していなかった。
- 00:09女はことさら肉を隠しがちであった。
- 00:13大抵は頭にゴム線のずきんをかぶって海茶や昆夜藍の色を波間に浮していた。
- 00:20そういうあり様を目撃したばかりの私の目には――それまたひとつで済まして、みんなの前に立っているこの西洋人がいかにも珍しく見えた。
- 00:31彼はやがて自分の脇をかえりみて、そこに転んでいる日本人に一言二言何か言った。その日本人は砂の上に落ちた手拭を拾い上げているところであったがそれを取り上げるや否や腰に牽いて、
Vale la pena notare: i tre sistemi di scrittura sono mescolati come li mescolerebbe chi scrive in giapponese, senza che nessuno lo abbia chiesto al motore. ゴム — il prestito olandese per la gomma — è in katakana, mentre 西洋人, 手拭 e 日本人 nello stesso brano sono in kanji e ogni particella e ogni desinenza verbale stanno in hiragana. 一言二言 è scritto in kanji invece che reso foneticamente, e il letterario 否や sopravvive intatto. Le virgole e i punti non sono mai stati pronunciati: sono stati collocati a partire dal fraseggio di chi legge, e cadono ai confini di proposizione dove li metterebbe un revisore giapponese.
Non è perfetta, e gli errori sono istruttivi. Sōseki aveva scritto 猿股一つ — l'occidentale se ne sta lì con addosso solo un paio di mutandoni — e il motore ha sentito それまたひとつ, una sequenza di kana dal suono plausibile che qui non significa nulla. L'elenco di colori 海老茶や紺や藍 è uscito come 海茶や昆夜藍, con kanji scelti per il suono invece che per il senso. Ecco che aspetto ha, in pratica, la pressione degli omofoni. E si tratta comunque di una lettura curata e ben scandita, vicina a una lezione o a un appunto dettato. Un'intervista in un izakaya rumoroso con tre persone che si sovrappongono non verrà altrettanto pulita; non lo sarà con nessun sistema automatico. La qualità della registrazione resta il fattore che più di ogni altro determina il risultato.
Registrazione: sezione 2 di こころ (Kokoro) di Natsume Sōseki, LibriVox (2014). Public Domain Mark 1.0. Estratto da 1:30 a 2:15.
Come ConvertSpeech gestisce il giapponese parlato
Il giapponese standard — hyōjungo, costruito sulla parlata di Tokyo — è quello che usano le registrazioni radiotelevisive, professionali e accademiche, e ConvertSpeech è ottimizzato proprio per questo. È anche la varietà il cui accento tonale il motore prende come riferimento, cosa che conta perché è il tono a distinguere nel parlato diverse coppie di parole comuni, prima ancora che il contesto abbia modo di intervenire.
Il Kansai-ben, parlato nell'area di Osaka, Kyoto e Kobe, è la varietà regionale più marcata che ti capiterà probabilmente di registrare, e si distingue per molto più che l'accento. La copula è や invece di だ, le negazioni si formano con -へん o -ん invece che con -ない, e le parole di uso quotidiano sono semplicemente diverse: おおきに per grazie, あかん per «non va bene», ちゃう per «non è così». Un Kansai-ben pronunciato con chiarezza si trascrive in modo utile, ma aspettati che il motore in alcuni punti tenda verso le forme standard, e riserva una rilettura più attenta all'audio fortemente dialettale. Le varietà del Tōhoku e del Kyushu sono ancora più lontane dallo standard: più una registrazione è dialettale, più la trascrizione si legge come giapponese standard che indossa un lessico regionale.
La cortesia viene resa così come è pronunciata, in entrambe le direzioni. Un parlato ricco di keigo — una telefonata di assistenza clienti, una presentazione formale, un'intervista a una persona di grado superiore — produce いらっしゃいます, させていただきます e ございます come sono stati detti, e il parlato informale tra amici produce forme piane e particelle omesse come sono state dette. Il motore non normalizza l'uno nell'altro, ed è il comportamento che serve: in giapponese il livello di cortesia fa parte del contenuto, non è un'impostazione stilistica. Dove invece fatica è nello stesso punto in cui faticano le persone: le forme umili e onorifiche di uno stesso verbo non assomigliano per nulla alla forma da dizionario, quindi un keigo insolito merita un'occhiata in fase di rilettura.
Consigli per una trascrizione precisa del giapponese
- Registra con un buon microfono e poco rumore di fondo — la qualità dell'audio è il fattore più importante in assoluto.
- Imposta la lingua su giapponese invece del rilevamento automatico, quando sai che la registrazione è in giapponese.
- Un interlocutore alla volta si trascrive meglio; le voci sovrapposte riducono la precisione.
- Per le interviste, attiva il riconoscimento degli interlocutori (funzione gratuita per gli utenti registrati) per indicare chi ha detto cosa.
- Rileggi per primi i nomi. I nomi di persona e di luogo giapponesi sono la cosa più difficile di qualsiasi registrazione, perché una stessa lettura corrisponde a più kanji possibili — un uomo presentato come Hiroshi può essere 博, 浩 o 寛 — e il suono da solo non permette di distinguerli.
- Poi passa in rassegna il lessico ricco di omofoni. 機械 e 機会 sono entrambi «kikai», 以外 e 意外 sono entrambi «igai», 関心 e 感心 sono entrambi «kanshin». Solo il contesto sceglie il kanji, quindi i passaggi tecnici e astratti sono quelli in cui è più facile che si nasconda un carattere sbagliato.