Ücretsiz Japonca Sesi Yazıya Çevirme
Japonca ses veya video dosyanızı yükleyin; dakikalar içinde doğru, düzenlenebilir bir transkript alın — otomatik, tarayıcı tabanlı ve başlangıcı ücretsiz.
Japoncayı, neredeyse tamamı Japonya'da yaşayan yaklaşık 125 milyon kişi konuşur ve bu dil, dünyanın en büyük medya, iş ve araştırma ekonomilerinden birini taşır. Japonca röportajlar, dersler, yönetim kurulu toplantıları ve video içerikleri durmadan kaydedilir ve bunların çoğunun eninde sonunda aranabilir metne dönüşmesi gerekir.
Japonca ayrıca bir konuşma tanıma motorundan, başka neredeyse hiçbir dilin istemediği bir şey ister: aynı anda üç yazı sistemiyle yazılır ve bunlar tek bir cümlenin içinde iç içe geçer. Kanji içerik kelimelerini, hiragana dil bilgisi eklerini ve çekimleri, katakana ise ödünç kelimeleri, yabancı adları ve yansıma sözcükleri taşır. Bunlar arasında seçim yapmak bir biçimlendirme tercihi değildir — transkriptin kendisidir. “kami” diye söylenen aynı heceler, kâğıt için 紙, tanrı için 神, saç için 髪 demektir: havada birebir aynı, sayfada üç farklı karakter; hangisinin doğru olduğuna yalnızca çevredeki cümle karar verir. Aşağıdaki örnekte bunun olduğunu izleyebilirsiniz: Japoncanın Felemenkçeden ödünç aldığı, lastik anlamındaki ゴム doğru biçimde katakana ile yazılmışken, aynı pasajdaki 西洋人 ve 手拭 kanji ile, çevrelerindeki ekler ise hiragana ile yazılmıştır.
Üstüne üstlük, yazılı Japoncada kelimeler arasına boşluk konmaz. Bir motor sadece sesleri yazıp gerisini boşluklara bırakamaz — her kelimenin nerede bittiğine kendisi karar etmek zorundadır, çünkü sığınabileceği görünür bir sınır yoktur. Noktalama da konuşulmaz; yani bir transkriptteki 、ve 。 duyularak değil, ifadenin akışından çıkarsanır. Konuşulan Japonca bu işin bir kısmını perde vurgusuna yıkar: 箸 (yemek çubukları), 橋 (köprü) ve 端 (kenar) hepsi “hashi”dir ve Tokyo konuşmasında perdenin nereye düştüğüyle ayırt edilir. Sayma bir katman daha ekler, çünkü Japonca nesneleri, sayıyla birlikte biçim değiştiren bir sınıflandırıcıyla sayar: üç uzun nesne 三本 (sanbon) iken altı tanesi 六本 (roppon) olur; yassı şeyler 枚, küçük hayvanlar ise 匹 alır.
Nezaket süs değil dil bilgisidir. Günlük konuşmadan keigo'ya geçmek bir fiili yumuşatmaz, onu değiştirir: bakan kişi muhatapsa 見る fiili ご覧になる, konuşanın kendisiyse 拝見する olur; 言う da aynı şekilde おっしゃる ya da 申す olur. Bunu yanlış yapan bir transkript sadece tuhaf okunmaz — yanlış toplumsal düzeyi rapor eder. Ses veya video dosyanızı yükleyin; motor, konuşulan Japoncayı, yazı sistemlerini bir Japon yazarın karıştıracağı gibi karıştırarak temiz ve aranabilir bir metne döker. Tarayıcınızda çalışır, kurulum gerektirmez ve ilk dakikalarınız hesap açmadan ücretsizdir.
Japonca dili hangi amaçlarla yazıya dökülüyor?
İş dünyası ve toplantılar
Japonca toplantıların ve görüşmelerin yazılı tutanaklarını tutun; kararlar ve yapılacaklar arayabileceğiniz bir metinde kayıt altına alınsın.
Medya ve içerik üreticileri
Video veya podcast sesinizden doğrudan, düzgün kanji ve kana ile Japonca altyazılar ve bölüm notları oluşturun.
Araştırmacılar ve öğrenciler
Japonca dersleri ve saha röportajlarını alıntılayıp kaynak gösterebileceğiniz ve üzerinden çalışabileceğiniz aranabilir metne dönüştürün.
Japonca bir transkript gerçekte nasıl görünür
Bu, sesli okuyan gerçek bir insanın 45 saniyelik gerçek kaydı; kendi dosyanızı işleteceğiniz gibi bizim AI motorumuzdan geçirildi. Sonrasında hiçbir şey düzeltilmedi. Oynat'a basın ve birlikte okuyun.
AI motoru, 20 saniye işlem
- 00:00私のじっとしている間にだいぶ多くの男が塩を浴びに出て来たが、いずれも胴と腕と股は出していなかった。
- 00:09女はことさら肉を隠しがちであった。
- 00:13大抵は頭にゴム線のずきんをかぶって海茶や昆夜藍の色を波間に浮していた。
- 00:20そういうあり様を目撃したばかりの私の目には――それまたひとつで済まして、みんなの前に立っているこの西洋人がいかにも珍しく見えた。
- 00:31彼はやがて自分の脇をかえりみて、そこに転んでいる日本人に一言二言何か言った。その日本人は砂の上に落ちた手拭を拾い上げているところであったがそれを取り上げるや否や腰に牽いて、
Dikkat etmeye değer: üç yazı sistemi, kimse motora böyle yap demeden, bir Japon yazarın karıştıracağı gibi karışmış. Felemenkçeden gelen ve lastik anlamına gelen ゴム katakana ile yazılmışken, aynı pasajdaki 西洋人, 手拭 ve 日本人 kanji ile, her ek ve fiil çekimi ise hiragana ile duruyor. 一言二言 sesletim üzerinden hecelenmek yerine kanji ile yazılmış ve edebî 否や olduğu gibi korunmuş. Virgüller ve noktalar hiç konuşulmadı; okuyucunun ifade akışından yerleştirildiler ve tam da bir Japon editörün koyacağı yerlere, cümlecik sınırlarına düştüler.
Kusursuz değil ve hatalar öğretici. Sōseki 猿股一つ yazmıştı — yani Batılı adam orada yalnızca bir mayo şortuyla duruyor — motor ise それまたひとつ duydu; gerçek gibi duran ama burada hiçbir anlamı olmayan bir kana dizisi. Renk listesi 海老茶や紺や藍 ise 海茶や昆夜藍 olarak çıktı; kanjiler anlama göre değil sese göre seçilmiş. Eşsesli baskısının pratikteki görüntüsü tam olarak budur. Üstelik bu, özenli ve net telaffuz edilen bir okuma; bir dersi ya da dikte edilmiş bir notu andırıyor. Üç kişinin birbirinin sözünü kestiği gürültülü bir izakaya röportajı bu kadar temiz çıkmaz; hiçbir otomatik sistemde çıkmaz. Sonucu belirleyen en büyük tek etken hâlâ kayıt kalitesidir.
Kayıt: Natsume Sōseki'nin こころ (Kokoro) romanının 2. bölümü, LibriVox (2014). Public Domain Mark 1.0. 1:30 – 2:15 arasından alıntı.
ConvertSpeech konuşulan Japoncayı nasıl işler
Yayıncılık, iş ve akademi kayıtlarının kullandığı biçim, Tokyo konuşması üzerine kurulu standart Japoncadır — hyōjungo — ve ConvertSpeech buna göre ayarlanmıştır. Motorun perde vurgusunda referans aldığı varyant da budur; bunun önemi, bağlamın devreye girme fırsatı bulmasından önce konuşmada birkaç yaygın kelime çiftini ayıran şeyin perde olmasıdır.
Osaka, Kyoto ve Kobe çevresinde konuşulan Kansai-ben, kaydetme ihtimalinizin en yüksek olduğu en güçlü bölgesel varyanttır ve aksandan fazlasıyla ayrışır. Ek fiil だ değil や'dır, olumsuzluk -ない yerine -へん veya -ん ile kurulur ve gündelik kelimeler doğrudan farklıdır: teşekkür için おおきに, olmaz için あかん, öyle değil için ちゃう. Net Kansai konuşması işe yarar biçimde yazıya dökülür, ama motorun yer yer standart biçimlere kaymasını bekleyin ve yoğun lehçeli sesi daha dikkatli gözden geçirin. Tōhoku ve Kyushu varyantları standarttan bir kat daha uzaktır; kayıt ne kadar lehçeliyse transkript o kadar “bölgesel kelimeler giymiş standart Japonca” gibi okunur.
Nezaket iki yönde de söylendiği gibi işlenir. Keigo yoğun konuşma — bir müşteri hizmetleri görüşmesi, resmî bir sunum, kıdemli biriyle yapılan bir söyleşi — いらっしゃいます, させていただきます ve ございます biçimlerini söylendiği gibi üretir; arkadaşlar arasındaki günlük konuşma da yalın biçimleri ve düşürülen ekleri söylendiği gibi üretir. Motor birini diğerine normalleştirmez; istediğiniz davranış da budur: Japoncada nezaket düzeyi bir biçem ayarı değil, içeriğin parçasıdır. Zorlandığı yer insanların da zorlandığı yerdir — aynı fiilin alçakgönüllü ve saygı biçimleri sözlük biçimine hiç benzemez, bu yüzden alışılmadık keigo'ya metni gözden geçirirken bir göz atmakta fayda vardır.
Doğru Japonca transkripsiyon için ipuçları
- İyi bir mikrofonla ve mümkün olduğunca az arka plan gürültüsüyle kayıt yapın — ses kalitesi en belirleyici tek etkendir.
- Kaydın Japonca olduğundan eminseniz, otomatik algılama yerine dili Japonca olarak ayarlı tutun.
- Aynı anda tek konuşmacı en iyi sonucu verir; yoğun söz kesişmesi doğruluğu düşürür.
- Röportajlarda kimin ne söylediğini etiketlemek için konuşmacı tanımayı açın (kayıtlı kullanıcılara ücretsiz bir özellik).
- Önce adları gözden geçirin. Japonca kişi ve yer adları her kaydın en zor kısmıdır, çünkü aynı okunuş birkaç olası kanjiye karşılık gelir — Hiroshi diye tanıtılan bir adam 博, 浩 ya da 寛 olabilir — ve ses tek başına bunları ayırt edemez.
- Sonra eşsesli yoğunluğu yüksek kelimeleri tarayın. 機械 ile 機会 ikisi de “kikai”, 以外 ile 意外 ikisi de “igai”, 関心 ile 感心 ikisi de “kanshin”dir. Kanjiyi yalnızca bağlam seçer; bu yüzden yanlış bir karakterin saklanma ihtimali en yüksek yerler teknik ve soyut pasajlardır.