Freie Konvertierungen übrig: 1

Kostenlose Spracherkennung für Telugu

Laden Sie Ihre Telugu-Audio- oder -Videodatei hoch und erhalten Sie innerhalb weniger Minuten ein bearbeitbares Transkript in Telugu-Schrift – automatisch, direkt im Browser und zum Einstieg kostenlos.

Telugu-Datei hier ablegen

ODER

Unterstützte Formate: MP3, WAV, MP4, FLAC, WEBM, M4A, OGG, OPUS, AAC, AMR, AIFF, AIF, WMA, MOV, MKV, AVI, MPG, MPEG, 3GP, WMV

Max. Dateigröße pro Upload: 95 MB

Kostenlos testen: Wir transkribieren die ersten 3 Minuten deiner Datei · Registriere dich kostenlos für mehr

Telugu hat laut der indischen Volkszählung von 2011 rund 83 Millionen Muttersprachler und ist damit nach Hindi, Bengali und Marathi die viertmeistgesprochene Muttersprache Indiens sowie die meistgesprochene der dravidischen Sprachen. Es ist Amtssprache von Andhra Pradesh und Telangana sowie des Distrikts Yanam von Puducherry und trägt sehr viel aufgezeichnete Sprache: Nachrichtensender, Universitätsvorlesungen, YouTube- und Podcast-Audio, Callcenter- und Büroaufnahmen sowie die in Hyderabad ansässige Filmindustrie, eine der größten Indiens.

Das Erste, was die meisten wissen wollen, ist, wie das Transkript eigentlich aussieht. Telugu hat eine eigene Schrift – eine Abugida, die aus dem gemeinsamen Telugu-Kannada-Schriftsystem des Mittelalters hervorging, mit ihren charakteristischen runden Buchstabenformen und dem kleinen v-förmigen Kopfstrich namens Talakattu. Jeder Konsonant trägt einen eingebauten Vokal, andere Vokale werden als angesetzte Zeichen geschrieben, und Konsonantenhäufungen werden als untergestellte Formen unter den Hauptbuchstaben gestapelt. ConvertSpeech schreibt Ihr Transkript in dieser Schrift, als తెలుగు, und nicht als romanisiertes „telugu" in lateinischen Buchstaben. Das ist praktisch relevant, denn die Schrift unterscheidet auch aspirierte von unaspirierten Konsonanten und kurze von langen Vokalen – und diese Unterschiede verändern die Bedeutung und nicht nur die Schreibung.

Telugu ist außerdem ganz anders gebaut als Hindi oder Englisch, und das prägt, wie ein Transkript aussieht. Es ist dravidisch und nicht indogermanisch, seine Grundwortstellung ist Subjekt-Objekt-Verb, und grammatische Beziehungen werden ausschließlich dadurch ausgedrückt, dass Suffixe hinten an ein Wort angehängt werden – Telugu hat überhaupt keine Präfixe und keine Infixe. Ein einziges gesprochenes Wort kann deshalb tragen, wofür das Deutsche einen ganzen Nebensatz braucht, und entsprechend lang auf der Seite ankommen. Dazu mischt das alltägliche städtische Telugu ständig Englisch bei, eine Gewohnheit, die weithin Tenglish genannt wird: Man sagt „chala thanks" statt dhanyavadamulu, und in Büros in Hyderabad, Visakhapatnam oder Vijayawada kann die Sprache mitten im Satz wechseln und sofort wieder zurückwechseln. Unsere Engine transkribiert diese englischen Wörter als Englisch innerhalb des Telugu-Textes, statt sie in Telugu-Schreibung zu pressen.

Laden Sie Ihre Audio- oder Videodatei hoch, und die Engine schreibt das gesprochene Telugu als sauberen, durchsuchbaren Text mit Zeichensetzung nieder – bereit zum Einfügen in ein Dokument, eine Untertiteldatei oder ein Übersetzungstool. Alles läuft im Browser, ohne Installation, und die ersten Minuten sind kostenlos, ganz ohne Konto.

Anwendungsfälle

Wofür Telugu transkribiert wird

Nachrichten, Interviews und Podcasts

Verwandeln Sie aufgezeichnete Telugu-Interviews und -Episoden in wenigen Minuten in zitierfähigen, durchsuchbaren Text, statt sie von Hand abzutippen.

Studierende und Vorlesungen

Wandeln Sie Telugu-Vorlesungen und Forschungsinterviews in Notizen um, die Sie durchsuchen, markieren und zitieren können.

Creator und Untertitel

Erstellen Sie Telugu-Untertitel, Shownotes und Beschreibungen direkt aus dem Audio Ihres Videos oder Podcasts.

Echtes Beispiel

So sieht ein Telugu-Transkript wirklich aus

Dies ist eine echte 45-Sekunden-Aufnahme eines menschlichen Sprechers, durch unsere KI-Engine geschickt – genau so, wie Sie Ihre eigene Datei verarbeiten würden. Nichts wurde nachträglich korrigiert. Drücken Sie auf Play und lesen Sie mit.

KI-Engine, 25 Sekunden Verarbeitung

  1. 00:00కడివుండెనూ, ఇది అంతయు చూచినూ ఇసారే అతడు ఇంటికి పోదలంపనట్టు కనిపించుచున్నది, స్నేహతుల వంటకూడా అతడు కొన్ననాళ్ళు నుండీ అంత విరివిగా తిరుగుచుండటలేదు.
  2. 00:11చక్రపాణి బస్స ఇనీసి బేటలోన ఏకమిద్దటిల్లు.
  3. 00:14చక్రపాణి మేడమీద ఏదీయో చింతించుచు అటు ఇటు తిరుగుచుండెనూ.
  4. 00:19కొంతసేపటికి అతడు తలెత్తి చూచెనూ.
  5. 00:22ఎదుటుండ మేడమీదను ఉన్న సుందరవిగ్రహము అతనిక కనబడెనూ.
  6. 00:26చక్రపాణి వికసిత వదనుడైయెనూ. మేడమీదను ఉన్న సుందరే కనక వచ్చి చక్రపాణి తో సంభాషించెనూ.
  7. 00:32"పాణీ!
  8. 00:33నీవీ మారేమీ ఇంకా నిద్రపోవుచున్నావూ పడవు తొరకలేదా? మీ ఊరినుండి చుకదురుకయ పడవు వచ్చింది.
  9. 00:40పోవేమీ!

Als Erstes lohnt sich der Blick auf die Schrift: Das Transkript kommt in Telugu-Schrift zurück und nicht als Telugu in lateinischen Buchstaben. Figurennamen überleben als lesbare Telugu-Wörter – చక్రపాణి für Chakrapani –, und die Konsonantenligaturen, die zwei Buchstaben zu einer einzigen Form stapeln, werden korrekt gebildet statt auseinandergerissen. Das Fragezeichen und das doppelte Anführungszeichen, das die direkte Rede eröffnet, setzt die Engine selbst.

Zwei ehrliche Anmerkungen. Telugu kommt gelegentlich romanisiert zurück statt in eigener Schrift – in diesem Ausschnitt ist das nicht passiert, aber es passiert oft genug, dass die Tipps weiter unten empfehlen, vor der Verwendung einen Blick auf den Anfang des Transkripts zu werfen. Und der Sprecher verwendet das ältere, förmliche literarische Telugu, in dem der Roman geschrieben ist; das Transkript folgt diesem Register, statt es in moderne umgangssprachliche Schreibungen umzuschreiben.

Das hier ist eine schnelle, zügig gelesene Dialogszene und damit schwerer als eine klar artikulierte Vorlesung oder ein Diktat. Eine ruhige Aufnahme, in der immer nur eine Person spricht, kommt merklich sauberer heraus. Der Ausschnitt endet schlicht dort, wo die 45 Sekunden zu Ende sind.

Aufnahme: „Visha Vahini" von Ramanuja Rao Somaraju, ein Telugu-Roman, der im frühen 20. Jahrhundert spielt, gelesen von Swapna für LibriVox (2015). Public Domain Mark 1.0. Ausschnitt aus Kapitel 1, 1:00 bis 1:45.

Varianten & Akzente

Telugu-Varietäten und förmliche gegenüber alltäglicher Sprache

Telugu variiert merklich von Region zu Region. Die Sprachwissenschaft gruppiert es üblicherweise in eine nördliche Varietät, die in der Region Telangana gesprochen wird, eine zentrale oder Küstenvarietät in den Küstendistrikten Andhras, eine südliche in Rayalaseema und eine östliche in Nordandhra. Die Schriftnorm ist weitgehend aus den Küstendistrikten hervorgegangen, weshalb die Küstensprache dem geschriebenen Telugu tendenziell am nächsten steht – das ist eine Tatsache über die Geschichte der Schriftnorm und kein Urteil über irgendeine Sprechweise.

Für die Transkription ist der Wortschatz der praktisch wichtigste Unterschied. Das Telangana-Telugu, und besonders die Sprache Hyderabads, trägt eine erhebliche Schicht persischer, arabischer und urduischer Lehnwörter, die ab dem 14. Jahrhundert unter dem Sultanat von Delhi und der späteren Dekkan-Herrschaft aufgenommen wurden. Alltagswörter für Haushaltsgegenstände, Essen und Verwaltung können vom Pendant an der Küste abweichen, und entlehnte Wörter sind statistisch die wahrscheinlichste Stelle, an der ein automatisches System ausrutscht. Ist Ihre Aufnahme stark Telangana-geprägt, prüfen Sie beim Korrekturlesen zuerst diese Wörter; Grammatik und Satzbau kommen einwandfrei durch.

Das Register zählt mindestens so viel wie die Region. Telugu kennt seit Langem eine große Kluft zwischen einem förmlichen literarischen Schriftstil und der Art, wie Menschen tatsächlich sprechen; im Lauf des 20. Jahrhunderts hat – nach einer langen Kampagne von Reformern wie Gidugu Venkata Ramamurthy – die moderne gesprochene Norm die ältere literarische Form in Druck, Unterricht und Rundfunk verdrängt. Beides ist weiterhin zu hören: Eine Nachrichtensendung oder eine förmliche Rede verwendet vollständige, sorgfältig ausgesprochene Verbendungen, während ein Interview, ein Vlog oder ein Telefonat sie stark verkürzt. Unsere Engine folgt dem Register der Aufnahme, statt das eine in das andere zu überführen – deshalb bleiben die literarischen Formen im Beispiel oben so erhalten, wie sie gelesen wurden.

Wie immer ist der größte Einzelfaktor die Aufnahmequalität. Ausgeprägter Dialekt, schnell und über Hintergrundgeräuschen gesprochen, ist für jedes automatische System eine Herausforderung – in Telugu wie in jeder anderen Sprache –, und keine Engine transkribiert das so zuverlässig wie ein sauberes Signal.

Tipps

Tipps für eine präzise Telugu-Transkription

FAQ

Telugu-Spracherkennung — Fragen

Ist die Spracherkennung für Telugu wirklich kostenlos?
Ja – Sie können Telugu-Audiodateien kostenlos und ohne Anmeldung transkribieren. Wenn Sie mehr Transkriptionszeit benötigen, legen Sie einfach ein kostenloses Konto an.
Kommt das Transkript in Telugu-Schrift oder in lateinischen Buchstaben?
In Telugu-Schrift. Die Engine schreibt తెలుగు statt romanisiertem Telugu, sodass der Text bereit ist zum Einfügen in ein Dokument, eine Untertiteldatei oder ein Übersetzungstool. Gelegentlich kommt eine Zeile doch in lateinische Buchstaben transliteriert zurück. Wir haben das über mehrere Testaufnahmen hinweg beobachtet, deshalb lohnt sich ein Blick auf die ersten Zeilen, bevor Sie das Transkript verwenden.
Was passiert, wenn Telugu und Englisch gemischt gesprochen werden?
Gemischte Sprache ist im Telugu normal, besonders in Städten und Büros, und ihr informeller Name lautet Tenglish. Englische Wörter und Wendungen werden als Englisch innerhalb des Telugu-Textes geschrieben, statt in Telugu-Buchstaben ausbuchstabiert zu werden – ein Satz, der auf halber Strecke die Sprache wechselt, liest sich also weiterhin natürlich. Stellen Sie die Sprache fest auf Telugu statt auf automatische Erkennung, damit eine längere englische Passage nicht die ganze Datei ins Englische zieht.
Kommt das System mit der Sprache Telanganas und der Küste Andhras zurecht?
Beides wird gut transkribiert. Die Schriftnorm steht der Küstensprache am nächsten, deshalb brauchen Telangana-Aufnahmen – besonders die Sprache Hyderabads mit ihren persischen, arabischen und urduischen Lehnwörtern – etwas eher eine Korrektur bei einzelnen entlehnten Wörtern. Grammatik und Satzbau kommen in beiden Fällen gleich gut durch.
Kann es Telugu von Tamil, Kannada oder Hindi unterscheiden?
Ja, und sie werden getrennt transkribiert. Telugu ist dravidisch und wird in einer eigenen Schrift geschrieben – es ist also eine andere Sprache als Hindi und keine Variante davon, und ebenso eine andere Sprache als seine dravidischen Nachbarn Tamil und Kannada. Telugu ausdrücklich auszuwählen statt der automatischen Erkennung liefert das zuverlässigste Ergebnis.
Ist das Transkript in förmlichem oder in alltäglichem Telugu?
Es folgt der Aufnahme. Förmliches literarisches Telugu aus einer Rede oder einer Lesung wird mit seinen vollständigen Verbendungen transkribiert, und das verkürzte, umgangssprachliche Telugu eines Interviews oder Vlogs so, wie es gesprochen wurde. Die Engine überführt das eine Register nicht in das andere.
Kann ich auch Telugu-Videos transkribieren, nicht nur Audio?
Ja. Auch MP4- und WEBM-Videodateien funktionieren – wir extrahieren die Tonspur und transkribieren das gesprochene Telugu, und genau das brauchen Sie für Untertitel.
Welche Audio- und Videoformate kann ich hochladen, und wie lange dauert es?
Alle gängigen Formate funktionieren — 20 insgesamt: Audio wie MP3, WAV, M4A, OGG oder FLAC und Video wie MP4, MOV, MKV, AVI oder WEBM. Die meisten Dateien sind je nach Länge innerhalb weniger Minuten fertig. Das 45-Sekunden-Beispiel oben brauchte 25 Sekunden.
Weitere Sprachen

Andere Sprache transkribieren