Conversions gratuites restantes: 1

Transcription japonais audio en texte, gratuite

Importez votre audio ou votre vidéo en japonais et obtenez en quelques minutes une transcription précise et modifiable — automatique, directement dans votre navigateur et gratuite pour commencer.

Déposez votre fichier en japonais ici

OU

Formats pris en charge: MP3, WAV, MP4, FLAC, WEBM, M4A, OGG, OPUS, AAC, AMR, AIFF, AIF, WMA, MOV, MKV, AVI, MPG, MPEG, 3GP, WMV

Taille max. par envoi: 95 MB

Essai gratuit : nous transcrivons les 3 premières minutes de votre fichier · Inscrivez-vous gratuitement pour en obtenir plus

Le japonais est parlé par environ 125 millions de personnes, presque toutes au Japon, et porte l'une des plus grandes économies mondiales des médias, des affaires et de la recherche. Interviews, cours, conseils d'administration et contenus vidéo en japonais sont enregistrés en permanence, et la plupart doivent tôt ou tard devenir du texte consultable.

Le japonais exige aussi d'un moteur de reconnaissance vocale quelque chose que presque aucune autre langue ne demande : il s'écrit dans trois systèmes à la fois, entrelacés au sein d'une même phrase. Les kanji portent les mots pleins, les hiragana la grammaire et les flexions, les katakana les emprunts, les noms étrangers et les onomatopées. Choisir entre eux n'est pas une question de mise en forme — c'est la transcription elle-même. Les mêmes syllabes prononcées « kami » s'écrivent 紙 pour le papier, 神 pour une divinité et 髪 pour les cheveux : identiques à l'oreille, trois caractères différents sur la page, et seule la phrase environnante décide lequel est le bon. Dans l'exemple ci-dessous, on voit la chose se produire : ゴム, le mot pour le caoutchouc que le japonais a emprunté au néerlandais, est correctement écrit en katakana, tandis que 西洋人 et 手拭, dans le même passage, sont en kanji et que les particules qui les entourent sont en hiragana.

À cela s'ajoute que le japonais écrit ne met aucun espace entre les mots. Un moteur ne peut pas se contenter de noter des sons en laissant l'espacement faire le reste : il doit décider où chaque mot s'achève, car il n'existe aucune frontière visible sur laquelle se rabattre. La ponctuation n'est pas prononcée non plus : les 、et 。 d'une transcription sont déduits du phrasé plutôt qu'entendus. Le japonais parlé s'appuie sur l'accent de hauteur pour une partie du travail : 箸 (les baguettes), 橋 (le pont) et 端 (le bord) se disent tous « hashi » et ne se distinguent, dans la langue de Tokyo, que par l'endroit où la hauteur retombe. Le comptage ajoute encore une couche, car le japonais compte les choses avec un spécificatif qui change de forme selon le nombre : trois objets longs se disent 三本 (sanbon) mais six 六本 (roppon), tandis que les objets plats prennent 枚 et les petits animaux 匹.

La politesse relève de la grammaire, non de l'ornement. Passer du registre familier au keigo n'adoucit pas un verbe, cela le remplace : 見る devient ご覧になる quand c'est l'interlocuteur qui regarde et 拝見する quand c'est le locuteur, et 言う devient おっしゃる ou 申す de la même façon. Une transcription qui se trompe là-dessus ne se lit pas seulement de travers — elle rapporte un registre social erroné. Importez votre audio ou votre vidéo : le moteur restitue le japonais parlé sous forme de texte propre et consultable, avec les trois écritures mêlées comme les mêlerait une personne qui écrit en japonais. Tout se passe dans votre navigateur, sans aucune installation, et vos premières minutes sont gratuites, sans même créer de compte.

Cas d’usage

Pourquoi transcrire japonais

Entreprises et réunions

Gardez des comptes rendus écrits de vos réunions et appels en japonais : décisions et points d'action sont consignés dans un texte que vous pouvez interroger.

Médias et créateurs

Générez sous-titres et notes d'épisode en japonais directement à partir de l'audio de vos vidéos ou podcasts, en kanji et en kana corrects.

Chercheurs et étudiants

Convertissez cours et entretiens de terrain en japonais en texte consultable, facile à citer, à référencer et à étudier.

Exemple réel

À quoi ressemble vraiment une transcription en japonais

Voici un véritable enregistrement de 45 secondes, lu par une personne réelle et passé dans notre moteur IA exactement comme vous passeriez votre propre fichier. Rien n'a été corrigé après coup. Lancez la lecture et suivez le texte.

moteur IA, 20 secondes de traitement

  1. 00:00私のじっとしている間にだいぶ多くの男が塩を浴びに出て来たが、いずれも胴と腕と股は出していなかった。
  2. 00:09女はことさら肉を隠しがちであった。
  3. 00:13大抵は頭にゴム線のずきんをかぶって海茶や昆夜藍の色を波間に浮していた。
  4. 00:20そういうあり様を目撃したばかりの私の目には――それまたひとつで済まして、みんなの前に立っているこの西洋人がいかにも珍しく見えた。
  5. 00:31彼はやがて自分の脇をかえりみて、そこに転んでいる日本人に一言二言何か言った。その日本人は砂の上に落ちた手拭を拾い上げているところであったがそれを取り上げるや否や腰に牽いて、

À remarquer : les trois écritures sont mêlées comme les mêlerait une personne écrivant en japonais, sans que personne n'ait eu à le demander au moteur. ゴム — l'emprunt néerlandais désignant le caoutchouc — est en katakana, tandis que 西洋人, 手拭 et 日本人, dans le même passage, sont en kanji et que chaque particule et chaque désinence verbale se trouve en hiragana. 一言二言 est écrit en kanji plutôt que transcrit phonétiquement, et le 否や littéraire est resté intact. Les virgules et les points n'ont jamais été prononcés : ils ont été placés d'après le phrasé du lecteur, et ils tombent aux frontières de propositions où un correcteur japonais les mettrait.

Ce n'est pas parfait, et les erreurs sont instructives. Sōseki avait écrit 猿股一つ — l'Occidental se tient là en simple caleçon de bain — et le moteur a entendu それまたひとつ, une suite de kana qui sonne vrai mais ne veut rien dire ici. L'énumération de couleurs 海老茶や紺や藍 est ressortie en 海茶や昆夜藍, avec des kanji choisis pour le son plutôt que pour le sens. Voilà à quoi ressemble concrètement la pression des homophones. Et il s'agit ici d'une lecture soignée et clairement articulée, proche d'un cours ou d'une note dictée. Une interview dans un izakaya bruyant, avec trois personnes qui se coupent la parole, ne ressortira pas aussi nette ; aucun système automatique n'y parviendra. La qualité de l'enregistrement reste de loin le facteur le plus déterminant.

Enregistrement : section 2 de こころ (Kokoro) de Natsume Sōseki, LibriVox (2014). Public Domain Mark 1.0. Extrait de 1:30 à 2:15.

Variantes et accents

Comment ConvertSpeech traite le japonais parlé

Le japonais standard — le hyōjungo, bâti sur la langue de Tokyo — est celui qu'emploient les enregistrements audiovisuels, professionnels et universitaires, et ConvertSpeech est optimisé pour lui. C'est aussi la variante dont le moteur prend l'accent de hauteur comme référence, ce qui compte, car c'est la hauteur qui sépare à l'oral plusieurs paires de mots courantes avant même que le contexte n'ait son mot à dire.

Le Kansai-ben, parlé autour d'Osaka, de Kyoto et de Kobe, est la variante régionale la plus marquée que vous ayez des chances d'enregistrer, et elle ne diffère pas seulement par l'accent. La copule est や et non だ, la négation se forme avec -へん ou -ん au lieu de -ない, et des mots du quotidien sont tout simplement différents : おおきに pour merci, あかん pour « ça ne va pas », ちゃう pour « ce n'est pas ça ». Un Kansai-ben clairement articulé se transcrit utilement, mais attendez-vous à ce que le moteur penche par endroits vers les formes standard, et relisez de plus près un audio fortement dialectal. Les parlers du Tōhoku et de Kyūshū s'écartent davantage encore de la norme ; plus un enregistrement est dialectal, plus la transcription se lit comme du japonais standard revêtu d'un vocabulaire régional.

La politesse est restituée telle qu'elle est prononcée, dans les deux sens. Une parole chargée de keigo — un appel au service client, une présentation formelle, un entretien avec une personne de rang supérieur — produit いらっしゃいます, させていただきます et ございます tels quels, et la conversation familière entre amis produit des formes neutres et des particules omises, également telles quelles. Le moteur ne normalise pas l'un vers l'autre, et c'est bien le comportement souhaitable : en japonais, le niveau de politesse fait partie du contenu, ce n'est pas un réglage de style. Là où il peine, c'est exactement là où les humains peinent aussi — les formes modestes et honorifiques d'un même verbe ne ressemblent en rien à la forme de dictionnaire, un keigo inhabituel mérite donc un coup d'œil à la relecture.

Conseils

Conseils pour une transcription précise du japonais

FAQ

Transcription japonais — questions

La transcription du japonais est-elle vraiment gratuite ?
Oui — vous pouvez transcrire de l'audio en japonais gratuitement, sans inscription. Créez un compte gratuit si vous avez besoin de plus de temps de transcription.
La transcription sort-elle en kanji et kana, ou en rōmaji ?
En kanji et en kana — du japonais écrit ordinaire, tel que ce discours s'écrirait normalement. Vous obtenez un mélange de kanji, de hiragana et de katakana avec la ponctuation japonaise, et non une version phonétique romanisée. Si vous avez besoin de rōmaji, convertissez le texte une fois terminé.
Comment le moteur choisit-il entre kanji, hiragana et katakana ?
Par le contexte, exactement comme le fait une personne qui écrit. Les mots pleins passent en kanji, les désinences grammaticales et les particules en hiragana, et les emprunts, noms étrangers et onomatopées en katakana. Dans l'exemple ci-dessus, le mot d'origine néerlandaise ゴム est bien en katakana tandis que 西洋人, dans la même phrase, est en kanji.
Que se passe-t-il avec des homophones comme 機械 et 機会 ?
Le moteur retient le kanji qui convient à la phrase environnante. Cela fonctionne bien dans la parole ordinaire, et c'est aussi l'endroit où l'on trouve le plus souvent une erreur — la transcription d'exemple de cette page contient précisément un dérapage de ce type, laissé en place à dessein. Le vocabulaire technique dense en homophones mérite une passe de relecture.
Le Kansai-ben et les autres parlers régionaux sont-ils pris en charge ?
Un Kansai-ben clairement articulé se transcrit utilement, même si la transcription peut par endroits pencher vers les formes standard. C'est le japonais standard qui donne les résultats les plus fiables ; plus un enregistrement s'en éloigne — une parole fortement marquée du Tōhoku ou de Kyūshū, par exemple — plus il demande de relecture, et cela vaut pour tout système automatique.
Le keigo est-il géré aussi bien que la langue familière ?
Les deux, tels qu'ils sont prononcés. Les formes honorifiques et modestes comme いらっしゃいます ou 拝見する sont transcrites telles quelles plutôt qu'aplaties en formes neutres, et la langue familière reste familière. Comme la politesse est grammaticale en japonais, cela préserve intact le registre de l'original.
Puis-je transcrire une vidéo en japonais, et quels formats puis-je importer ?
Oui pour la vidéo — MP4 et WEBM fonctionnent, et nous extrayons automatiquement le japonais parlé. Tous les formats courants sont pris en charge, 20 au total : audio comme MP3, WAV, M4A, OGG ou FLAC, et vidéo comme MP4, MOV, MKV, AVI ou WEBM.
Combien de temps prend la transcription ?
La plupart des fichiers sont prêts en quelques minutes, selon la durée de l'enregistrement. L'extrait de 45 secondes ci-dessus a demandé 20 secondes.
Autres langues

Transcrire une autre langue