무료 스페인어 음성 텍스트 변환
스페인어 오디오나 비디오를 업로드하면 몇 분 안에 편집 가능한 녹취록을 받을 수 있습니다 — 악센트와 ñ, 거꾸로 된 물음표까지 포함해서, 브라우저에서, 무료로 시작하세요.
스페인어는 약 5억 명이 모국어로 사용해 중국어 다음으로 많고, 20개국의 공용어입니다 — 스페인, 적도 기니, 그리고 라틴아메리카 18개국이며, 푸에르토리코에서도 공용어입니다. 그만큼 널리 퍼져 있기 때문에 스페인어 녹음은 마드리드의 뉴스룸, 멕시코시티의 콜센터, 부에노스아이레스의 팟캐스트 스튜디오, 안데스의 현장 조사에서 두루 들어옵니다. 모두 같은 언어를 글로 쓰지만, 그중 어느 둘도 똑같이 말하지 않습니다.
스페인어 철자는 소리와 거의 그대로 대응합니다. 그래서 어려움이 다른 곳으로 옮겨 갑니다 — 바로 부호입니다. 스페인어의 틸데(악센트 부호)는 장식이 아니라 의미를 나릅니다. papá는 아빠이고 papa는 감자입니다. sí는 “네”이고 si는 “만약”입니다. término, termino, terminó는 명사, 1인칭, 3인칭이며 이들을 가르는 것은 악센트가 어디에 놓이느냐뿐입니다. ñ는 모자를 쓴 n이 아니라 그 자체로 독립된 글자입니다 — año는 해(年)이고, ano는 그렇지 않습니다. ConvertSpeech는 이 모두를 제대로 씁니다. 읽을 만한 스페인어와 앙상한 기계 출력을 가르는 것이 바로 이 부분입니다.
그다음은 거꾸로 된 부호입니다. 스페인어는 의문문을 ¿로, 감탄문을 ¡로 열고, 그것도 질문이 실제로 시작되는 자리에서 엽니다 — 문장 첫머리가 아니라 문장 중간인 경우가 많죠. 이것은 좌우 대칭이라는 겉모습보다 훨씬 중요합니다. 스페인어는 어순만으로 의문문과 평서문이 갈리지 않는 경우가 잦기 때문입니다. “tienes hambre”와 “¿tienes hambre?”는 단어가 똑같고, 어느 쪽인지 알려 주는 것은 부호뿐입니다. 아래 예시 녹취록에서는 엔진이 쉼표 뒤 문장 한가운데에 ¿를 넣는 모습을 볼 수 있습니다 — 사람 편집자가 넣을 바로 그 자리입니다.
발음이 마지막 층을 더합니다. 이건 오디오가 아무리 깨끗해도 사라지지 않습니다. 세세오(seseo) 화자는 casa와 caza를 똑같이 발음하고, 예이스모(yeísmo)는 cayó와 calló를 같은 소리로 만들며, 스페인어에서 b와 v는 한 소리이고 h는 묵음입니다 — 그래서 tuvo와 tubo, 또는 haya와 halla와 aya 중 무엇을 쓸지는 문맥으로만 정해집니다. 오디오나 비디오를 업로드하면 엔진이 말한 스페인어를 구두점까지 갖춘 깔끔하고 검색 가능한 텍스트로 옮겨 적습니다. 브라우저에서 작동해 설치가 필요 없으며, 처음 몇 분은 계정 없이 무료입니다.
스페인어(스페인) 음성 변환의 활용 분야
기자와 국경을 넘는 인터뷰
화자가 세비야 사람이든 과달라하라 사람이든 몬테비데오 사람이든, 스페인어 인터뷰 녹음을 몇 분 만에 인용 가능한 텍스트로 바꾸세요 — 하나의 프로젝트, 여러 억양, 하나의 녹취록.
연구자와 현장 조사
스페인어 강의, 구술사, 포커스 그룹을 먼저 타이핑할 필요 없이 인용하고 코딩하고 분석할 수 있는 검색 가능한 노트로 변환하세요.
팟캐스터와 크리에이터
에피소드 오디오에서 스페인어 쇼 노트, 자막, 기사를 바로 만들어 지난 콘텐츠까지 소리뿐 아니라 검색 가능한 텍스트로 남기세요.
스페인어 녹취록은 실제로 이렇게 나옵니다
사람이 읽은 45초짜리 실제 녹음을, 여러분이 직접 파일을 올릴 때와 똑같이 저희 AI 엔진에 통과시킨 결과입니다. 이후에 손으로 고친 곳은 하나도 없습니다. 재생 버튼을 누르고 함께 읽어 보세요.
AI 엔진, 처리 24초
- 00:00Sacristán de la iglesia de Monserrate, le destinaba a seguir la carrera de derecho, porque se le había metido en la cabeza que el mocoso aquel llegaría a ser personaje, quizá orador célebre, ¿por qué no ministro?
- 00:13La futura celebridad habló así a su compañero: «¡Mia tú, Carso!
- 00:21si a mí me dieran esas chanzas, de la galleta que les pegaba les ponía la cara verde.
- 00:26Pero tú no tienes coraje.
- 00:28Yo digo que no se deben poner motes a las personas.
- 00:32¿Sabes tú quién tiene la culpa?
- 00:34Pues Posturitas, el de la casa de empeños; ayer fue contando que su mamá había dicho que a tu abuela y a tus tías las llaman las miau, porque tienen.
눈여겨볼 점: 첫 줄은 ¿por qué no ministro?로 끝나는데, ¿가 문장 첫머리가 아니라 쉼표 뒤 문장 한가운데, 질문이 실제로 시작되는 바로 그 자리에서 열립니다 — 자동으로 만든 스페인어 텍스트가 가장 흔히 틀리는 규칙이죠. 직접화법은 «¡Mia tú,로 시작하는데, 엔진이 스페인어식 꺾쇠 인용부호와 거꾸로 된 감탄부호를 스스로 골랐습니다. 악센트도 단어를 바꾸는 자리에 정확히 떨어집니다. ¿Sabes tú quién tiene la culpa?의 tú와 quién에는 악센트가 붙고, a tu abuela의 tu에는 붙지 않습니다. Sacristán, había, llegaría, quizá, célebre, compañero, ponía, empeños, mamá, tías가 모두 정확하게 나옵니다. 완벽하지는 않습니다 — 소설에서 그 소년의 이름은 Cadalso인데 녹취록은 Carso로 적었고, 본당 이름 Monserrat이 Monserrate가 되었습니다. 스페인어 녹취록이 가장 먼저 미끄러지는 곳은 고유명사입니다.
이 녹음은 또박또박 정성 들여 읽은 것으로, 실제 대화보다는 강의나 구술 메모에 가깝습니다. 세 사람이 동시에 떠드는 시끄러운 카페 인터뷰나, 음절 끝 s를 죄다 삼키는 빠른 카리브 화자라면 이만큼 깨끗하게 나오지 않습니다 — 어떤 자동 시스템도 마찬가지죠. 마지막 줄이 문장 중간에서 끊기는 것은 45초가 거기서 끝나기 때문입니다. 결과를 좌우하는 가장 큰 요인은 여전히 녹음 품질입니다.
녹음: 베니토 페레스 갈도스 『Miau』 1장, LibriVox(2026). Public Domain Mark 1.0. 3:29~4:14 구간 발췌.
지원하는 스페인어 억양과 지역 변이
유럽(카스티야) 스페인어는 스페인어권 대부분이 잃어버린 구별을 지키고 있습니다. e나 i 앞의 c와, z를 /θ/ — 영어 think의 “th” — 로 발음해서, casa와 caza가 종이 위에서뿐 아니라 귀로도 다른 단어입니다. 이 현상의 전문 용어는 디스틴시온(distinción)이며, ceceo가 아닙니다 — ceceo는 반대 방향의 병합, 즉 /s/ 자체를 /θ/로 실현하는 현상으로, 스페인어 표준이 아니라 안달루시아 일부 지역의 지역적 특징입니다. 이베리아반도 발화는 또한 vosotros와 그 고유한 동사 어미 — habláis, tenéis, sois, vosotros os — 를 만나는 곳이기도 한데, 이 형태들은 라틴아메리카 녹음에는 아예 나오지 않습니다.
멕시코 스페인어는 화자 수로 가장 큰 단일 변이이면서 전사하기 가장 수월한 축에 듭니다. 음절 끝 s가 또렷하게 유지되고 리듬이 고르기 때문입니다. 한 번 더 봐야 할 것은 어휘와 나와틀어 계통 지명입니다 — elote, popote, chamaco, guajolote 같은 단어들이죠. 그리고 글자 x가 있습니다. México, Oaxaca, Xalapa에서는 j처럼 발음되지만, taxi에서는 /ks/, Xochimilco에서는 “sh”로 발음됩니다. 철자만 보고는 어느 쪽인지 예측할 수 없으니 고유명사는 훑어볼 만합니다.
부에노스아이레스와 몬테비데오 일대의 리오플라텐세 스페인어에는 텍스트 자체를 바꾸는 특징이 둘 있습니다. 보세오(voseo)는 tú를 vos로 바꾸고 고유한 동사 형태를 가집니다 — vos hablás, vos tenés, vos sos, 그리고 vení, mirá, decime 같은 명령형이죠. 이것들은 tú eres로 정규화해야 할 오류가 아니라 올바른 스페인어입니다. 둘째는 셰이스모(žeísmo)입니다. ll과 y를 “sh” 또는 “zh” 소리로 발음해서 calle가 “cashe”, yo가 “sho”처럼 들립니다. 엔진은 어떻게 발음되었는지가 아니라 그 단어가 무엇인지를 적기 때문에, 결과물은 표준 철자로 남습니다.
카리브 스페인어 — 쿠바, 푸에르토리코, 도미니카공화국, 베네수엘라와 콜롬비아의 해안 지역 — 는 어떤 자동 시스템에게도 가장 어려운 무리이고, 거기에는 솔직한 이유가 있습니다. 음절 끝 s가 h로 약화되거나 아예 탈락해서, los dos는 “loh doh”가 되고 las casas가 la casa와 똑같이 들릴 수 있습니다. 그 s가 바로 복수를 표시하는 요소이므로, 엔진은 화자가 아예 발음하지 않은 문법 정보를 오직 문맥만으로 복원해야 합니다. 어말 자음이 약해지고, para는 pa로 줄고, 속도도 빠릅니다. 다른 어디보다 이곳에서 깨끗한 오디오가 큰 도움이 됩니다.
페루, 볼리비아, 에콰도르 고지대의 안데스 스페인어는 정반대 쪽에 있습니다. 보수적이어서 음절 끝 s가 온전히 살아 있고, 일부 지역에서는 다른 곳에서 예이스모가 지워 버린 옛 ll/y 구별이 아직 살아 있습니다. 까다로운 것은 소리가 아니라 어휘입니다 — 케추아어와 아이마라어에서 온 차용어와 지명이 일상 발화에 섞여 들고, 이중언어 화자는 그 언어들의 모음 패턴을 보이기도 합니다. 칠레 스페인어는 따로 경고할 만합니다. 빠르고 기식음화가 심하며 ¿cachái?, ¿estái? 같은 축약 동사 어미를 쓰는 이 변이는 제대로 받아 적기 가장 까다로운 축에 듭니다.
정확한 스페인어 전사를 위한 팁
- 좋은 마이크로, 배경 소음을 최소화해 녹음하세요 — 오디오 품질이 가장 큰 요인입니다.
- 녹음이 스페인어인 것을 알고 있다면 자동 감지 대신 언어를 스페인어로 지정해 두세요.
- 한 번에 한 사람씩 말할 때 가장 잘 전사됩니다. 말이 심하게 겹치면 어떤 언어든 정확도가 떨어집니다.
- 인터뷰라면 화자 구분 기능(가입 시 무료 제공)을 켜서 누가 무슨 말을 했는지 표시하세요.
- 악센트부터 교정하세요. 스페인어에서 틸데는 장식이 아니라 문법입니다. 악센트만이 유일한 차이인 짝과 세 쌍을 확인하세요 — término / termino / terminó, público / publico / publicó, papá / papa, sí / si, él / el, 그리고 ñ가 들어간 모든 단어.
- 그다음에는 소리만으로는 가릴 수 없는 동음이의어를 훑으세요. 세세오는 casa와 caza를 같게 만들고, 예이스모는 cayó와 calló에 같은 일을 하며, b와 v는 한 소리이고 h는 묵음입니다 — 그래서 tuvo / tubo, haya / halla, votar / botar, a ver / haber는 모두 문맥에 달려 있고 실수를 찾을 가능성이 가장 높은 자리입니다.