スペイン語の音声テキスト変換(無料)
スペイン語の音声や動画をアップロードするだけで、数分で編集可能な文字起こしが完成します。アクセント記号もñも逆さ疑問符も込みで、ブラウザ完結、無料で始められます。
スペイン語の母語話者は約5億人で、これは北京官話に次ぐ世界第2位です。公用語とされているのは20か国 — スペイン、赤道ギニア、そしてラテンアメリカの18か国 — に加えてプエルトリコでも使われています。この広がりゆえに、スペイン語の録音はマドリードの報道現場、メキシコシティのコールセンター、ブエノスアイレスのポッドキャストスタジオ、アンデスのフィールド調査から届きます。書く言語は同じでも、話し方はどれ一つとして同じではありません。
スペイン語の綴りは音とよく対応しているため、難しさは別のところに移ります。記号です。ティルデ(アクセント記号)は飾りではなく、意味を担います。papáは父、papaはじゃがいも。síは「はい」、siは「もし」。término、termino、terminóは、アクセントの位置だけで名詞・一人称・三人称に分かれます。ñは帽子をかぶったnではなく独立した1文字で、añoは「年」、anoはまったく別の語です。ConvertSpeechはこれらをすべて正しく書き出します。読めるスペイン語と、削ぎ落とされた機械出力を分けるのは、まさにこの点です。
そして逆さ記号があります。スペイン語は疑問文を¿で、感嘆文を¡で開き、しかも「疑問が実際に始まる位置」で開きます。それは文頭ではなく文の途中であることも珍しくありません。この記号は見た目の対称性以上に重要です。スペイン語では語順が疑問文と平叙文を区別しないことが多く、「tienes hambre」と「¿tienes hambre?」は同じ語の並びだからです。どちらなのかを読み手に伝えているのは、この記号なのです。下のサンプルでは、エンジンが文中のコンマの後、まさに人間の編集者が置くであろう位置に¿を入れているのが見て取れます。
発音がもう一つの層を加えます。これはどれだけクリアな音声でも消えません。セセオ(seseo)の話者はcasaとcazaを同じに発音し、ジェイスモ(yeísmo)はcayóとcallóを同じ音にします。スペイン語ではbとvは同じ音で、hは無音です。そのためtuvoとtubo、hayaとhallaとayaの綴り分けは、文脈でしか決められません。音声や動画をアップロードすれば、エンジンが話されたスペイン語を句読点付きの、きれいで検索可能なテキストとして書き出します。ブラウザだけで動作し、インストール不要、最初の数分間はアカウントなしで無料で使えます。
スペイン語 (スペイン) の文字起こしの活用シーン
記者・国境をまたぐ取材
録音したスペイン語のインタビューを数分で引用可能なテキストに変換。話者がセビーリャ出身でも、グアダラハラでも、モンテビデオでも構いません。一つの企画に複数のアクセント、それでも文字起こしは一つです。
研究者・フィールド調査
スペイン語の講義・オーラルヒストリー・フォーカスグループを、先に打ち込む手間なしに、引用・コーディング・分析ができる検索可能なノートに変換できます。
ポッドキャスター・クリエイター
エピソード音声からスペイン語のショーノート・字幕・記事を直接作成。過去回のアーカイブも、音だけでなく検索できるテキストになります。
スペイン語の文字起こしは実際にどう仕上がるのか
実際の人間の朗読を録音した45秒の音声を、皆さんがご自分のファイルを処理するのとまったく同じようにAIエンジンにかけた結果です。あとから手直しは一切していません。再生しながら読んでみてください。
AIエンジン、処理24秒
- 00:00Sacristán de la iglesia de Monserrate, le destinaba a seguir la carrera de derecho, porque se le había metido en la cabeza que el mocoso aquel llegaría a ser personaje, quizá orador célebre, ¿por qué no ministro?
- 00:13La futura celebridad habló así a su compañero: «¡Mia tú, Carso!
- 00:21si a mí me dieran esas chanzas, de la galleta que les pegaba les ponía la cara verde.
- 00:26Pero tú no tienes coraje.
- 00:28Yo digo que no se deben poner motes a las personas.
- 00:32¿Sabes tú quién tiene la culpa?
- 00:34Pues Posturitas, el de la casa de empeños; ayer fue contando que su mamá había dicho que a tu abuela y a tus tías las llaman las miau, porque tienen.
注目したいのは1行目です。¿por qué no ministro?で終わっていますが、¿は文頭ではなく、コンマの後、つまり疑問が実際に始まる位置で開かれています。自動のスペイン語出力がいちばん外しやすいのが、このルールです。会話文は«¡Mia tú,と始まり、エンジンはスペイン語式の山括弧引用符と逆さ感嘆符を自分で選んでいます。アクセント記号は、語の意味が変わるところに正しく落ちています。¿Sabes tú quién tiene la culpa?のtúとquiénには付き、a tu abuelaの無強勢のtuには付いていません。Sacristán、había、llegaría、quizá、célebre、compañero、ponía、empeños、mamá、tíasもすべて正しく出ています。ただし完璧ではありません。少年は原作ではCadalsoという名ですが文字起こしはCarsoとし、教区名MonserratはMonserrateになっています。スペイン語の文字起こしが最初に崩れるのは、やはり固有名詞です。
これは丁寧にはっきりと読み上げられた音声で、実際の会話というより講義や口述メモに近い条件です。三人が同時に話す騒がしいカフェでのインタビューや、音節末のsをことごとく飲み込む早口のカリブの話者が、ここまできれいに仕上がることはありません。どんな自動システムでも同じです。最終行が文の途中で切れているのは、単に45秒がそこで終わっているからです。結果を左右する最大の要因は、やはり録音の品質です。
録音:ベニート・ペレス・ガルドス『Miau』第1章、LibriVox(2026年)。Public Domain Mark 1.0。3:29〜4:14の抜粋。
対応するスペイン語のアクセントと地域変種
ヨーロッパの(カスティーリャ)スペイン語は、スペイン語圏の大半が失った区別を保っています。eとiの前のcとzを/θ/、つまり英語thinkのth音で発音するため、casaとcazaは紙の上だけでなく耳でも別の語です。これを指す専門用語はdistinción(区別)であって、ceceoではありません。ceceoはその逆の合流、すなわち/s/自体が/θ/として実現される現象で、スペインの標準ではなくアンダルシアの一部地域の特徴です。またイベリア半島の話し方には、vosotrosとその固有の動詞語尾 — habláis、tenéis、sois、vosotros os — が現れます。これらはラテンアメリカの録音にはまったく出てきません。
メキシコのスペイン語は話者数で最大の変種であり、文字起こしの上では最も扱いやすい部類です。音節末のsははっきり発音され、リズムも均一です。見直しが必要なのは語彙と、ナワトル語由来の地名です。elote、popote、chamaco、guajoloteといった語、そして文字xの読みです。México、Oaxaca、Xalapaではjのように、taxiでは/ks/、Xochimilcoでは「シュ」の音になります。綴りからは何も予測できないため、固有名詞は確認しておく価値があります。
ブエノスアイレスやモンテビデオ周辺のリオプラテンセ・スペイン語には、テキストそのものを変える特徴が2つあります。1つはボセオ(voseo)で、túの代わりにvosを使い、専用の動詞形を取ります。vos hablás、vos tenés、vos sos、命令形のvení、mirá、decimeなどです。これらは正しいスペイン語であり、tú eresに直すべき誤りではありません。もう1つはジェイスモの一種であるシェイスモ(žeísmo)で、llとyが「シュ」「ジュ」のような音になり、calleは「カシェ」、yoは「ショ」のように聞こえます。エンジンは発音の仕方ではなく語そのものを書き出すため、出力は標準的な綴りのままです。
カリブのスペイン語 — キューバ、プエルトリコ、ドミニカ共和国、ベネズエラとコロンビアの沿岸部 — は、どんな自動システムにとっても最も難しい系統であり、それには正直な理由があります。音節末のsがhのように帯気化するか完全に脱落するため、los dosは「loh doh」となり、las casasはla casaと区別がつかなくなることがあります。そのsこそが複数形を示す標識ですから、エンジンは話者が一度も発音しなかった文法情報を、文脈だけを頼りに復元しなければなりません。語末の子音は弱まり、paraはpaに縮まり、テンポも速い。ここでは録音のクリアさが、どこよりも効いてきます。
ペルー、ボリビア、エクアドルの高地で話されるアンデスのスペイン語は対極にあります。保守的で、音節末のsは損なわれず、他地域ではジェイスモが消し去った古いll/yの区別が今も生きている地域さえあります。難しさは音ではなく語彙のほうにあり、ケチュア語やアイマラ語からの借用語と地名が日常会話に織り込まれ、バイリンガルの話者にはそれらの言語由来の母音の傾向が現れることもあります。チリのスペイン語には別途の注意が必要です。速く、帯気化が強く、¿cachái?や¿estái?のような縮約された動詞語尾を伴うため、正確に書き出すのが最も骨の折れる変種の一つです。
スペイン語を正確に文字起こしするコツ
- 良いマイクを使い、背景ノイズを最小限に抑えて録音しましょう。音質こそが最大の決め手です。
- 録音がスペイン語だと分かっている場合は、自動検出ではなく言語をスペイン語に設定しておきましょう。
- 一度に一人ずつ話すのが最も正確です。声の重なりが多いと、どの言語でも精度が下がります。
- インタビューでは話者識別(登録ユーザー向けの無料機能)を有効にして、誰が何を言ったかをラベル付けしましょう。
- まずアクセント記号から校正しましょう。スペイン語のティルデは飾りではなく文法だからです。それだけが違いになるペア・トリオを確認してください。término / termino / terminó、público / publico / publicó、papá / papa、sí / si、él / el、そしてñを含む語すべてです。
- 次に、音だけでは決着しない同音異義語をざっと見ましょう。セセオはcasaとcazaを同一にし、ジェイスモはcayóとcallóに同じことをします。bとvは同じ音、hは無音です。tuvo / tubo、haya / halla、votar / botar、a ver / haberはいずれも文脈頼みであり、最も間違いが見つかりやすい箇所です。