Zum Hauptinhalt springen

„Audio in Text übersetzen“: Was es eigentlich bedeutet

Autor: Veröffentlicht: Zuletzt geprüft:

„Audio in Text übersetzen“ ist ein Suchbegriff, der zwei verschiedene Aufgaben abdeckt. Die meisten Leute, die es tippen, haben Audio in einer Sprache, die sie verstehen, und möchten, dass die Rede aufgeschrieben wird. Eine kleinere Gruppe verfügt über Audioaufnahmen in einer Sprache, die sie nicht sprechen, und möchte die Bedeutung in einer anderen Sprache hören. Die erste Aufgabe ist die Transkription. Die zweite fügt zusätzlich eine Übersetzung hinzu. Zu wissen, welches Sie tatsächlich benötigen, erspart Ihnen viel Verwirrung, da die Werkzeuge und Schritte nicht die gleichen sind.

Diese Anleitung trennt beides, zeigt, wie man Audiodaten transkribiert, die zufällig in einer anderen Sprache vorliegen, und erklärt, was zu tun ist, wenn Sie wirklich eine Übersetzung benötigen. Hushscript kann ein Transkript in derselben Sprache zurückgeben oder das Quellaudio transkribieren und ausgewählte Zielsprachenübersetzungen hinzufügen, wenn Sie diese Ziele vor dem Hochladen auswählen. Die Übersetzung ist Teil der Upload-Optionen und kein nachträglicher Wechsel in der Transkriptansicht.

Transkription versus Übersetzung

Die Transkription wandelt Sprache in Text in derselben Sprache um. Sie haben eine englische Interviewaufzeichnung und erhalten ein englisches Textdokument. Sie haben einen französischen Podcast und erhalten ein französisches Transkript. Die Wörter auf der Seite sind die Wörter, die gesprochen wurden. Nichts ändert die Sprache.

Übersetzung konvertiert Text von einer Sprache in eine andere. Französischer Text wird zu englischem Text. Es funktioniert mit Text, nicht mit Ton, und es muss sowohl die Ausgangssprache als auch die Zielsprache kennen. Die Europäische Kommission trennt Übersetzung von dolmetschen in gesprochener Sprache; Die gleiche Unterscheidung hilft zu erklären, warum sich hinter „Audio in Text übersetzen“ zwei separate Aufgaben verbergen können.

Warum sagen also so viele Leute „übersetzen“, wenn sie „trankribieren“ meinen? Das Wort wird lose verwendet, so wie jemand sagt, er müsse eine PDF-Datei in eine Word-Datei „übersetzen“, obwohl er eigentlich nur das Format konvertieren meint. Der Wechsel von Audio zu Text fühlt sich an, als würde man zwischen zwei Arten von Medien übersetzen, auch wenn sich die Sprache nicht geändert hat. Diese informelle Verwendung ist der Grund dafür, dass dieser Suchbegriff so häufig vorkommt, und deshalb suchen die meisten Leute, die ihn eingeben, nach einem Transkriptionstool.

Eine schnelle Möglichkeit, herauszufinden, welchen Job Sie benötigen: Können Sie die Aufnahme verstehen? Wenn Sie können und es nur aufgeschrieben haben möchten, ist das eine Transkription. Wenn Sie es nicht verstehen und die Bedeutung in Ihrer eigenen Sprache haben möchten, ist das eine Transkription, gefolgt von einer Übersetzung.

Audio in derselben Sprache ist eine Transkription

Wenn Sie eine englische Aufnahme haben und diese als Text haben möchten, ist das eine Transkription. Wenn Sie eine spanische Aufnahme haben und ein spanisches Transkript wünschen, ist das auch eine Transkription. Sie ändern nicht die Sprache. Sie ändern das Format von Ton zu Wörtern auf einer Seite.

Dies ist die häufigste Absicht hinter der Suche und genau dafür wurde Hushscript entwickelt. So funktioniert es, von Anfang bis Ende.

  1. Legen Sie Ihre Datei unter /audio-to-text ab. Eine 30-sekündige, mit Sprecher gekennzeichnete Vorschau wird direkt im Browser gerendert, ohne dass ein Konto erforderlich ist, sodass Sie die Qualität sehen können, bevor Sie sich auf etwas festlegen.
  2. Melden Sie sich mit Ihrer E-Mail-Adresse an, um den Rest zu transkribieren. Die ersten 30 Minuten sind einmalig kostenlos. Das Hinzufügen einer Karte ist der schnellste Weg: Durch eine Vormerkung von einem Dollar wird die Karte bestätigt, dann sofort gelöscht und nie belastet. Wenn Sie lieber eine andere in Ihrem Land verfügbare Zahlungsmethode nutzen möchten, erhalten Sie die Freiminuten stattdessen bei Ihrem ersten Einkauf. In beiden Fällen ist keine Karte erforderlich.
  3. Laden Sie die vollständige Datei hoch. Wenn es sich um ein Video handelt, wird das Audio zuerst in Ihrem Browser extrahiert, sodass das Video selbst auf Ihrem Gerät verbleibt und nur das Audio den Server erreicht.
  4. Wählen Sie die Transkriptionsoptionen. Belassen Sie die automatische Erkennung der Ausgangssprache oder wählen Sie sie selbst aus. Wählen Sie dann vor dem Hochladen ggf. Übersetzungen in die Zielsprache aus.
  5. Lesen, neu kennzeichnen und exportieren. Benennen Sie „Sprecher A“ in einen richtigen Namen um und laden Sie dann das Transkript in einem der 21 Exportformate (TXT, SRT, VTT, DOCX, PDF und mehr) oder als passwortgeschütztes .husharchive herunter. Übersetzte Transkripte werden als Sprachregisterkarten angezeigt und können pro Sprache exportiert werden.

Sprecherlabels und Zeitstempel werden unabhängig von der Sprache automatisch zurückgegeben. Wenn Sie vor dem Hochladen keine Übersetzungsziele auswählen, ist das Transkript, das Sie erhalten, in derselben Sprache wie die Audiodatei, da dies bei der Transkription der Fall ist.

Ein funktionierendes Beispiel

Angenommen, Sie zeichnen ein 40-minütiges Interview mit einem Kollegen auf, der Portugiesisch spricht, und Sie verstehen beide Portugiesisch. Sie möchten eine schriftliche Aufzeichnung, aus der Sie später zitieren können.

Sie legen die Datei unter /audio-to-text ab und die Vorschau zeigt die erste halbe Minute, bereits aufgeteilt in Sprecher A und Sprecher B. Die Akzente und das Portugiesisch kommen klar zur Geltung, also melden Sie sich an und laden die gesamte Aufnahme hoch. Wenn der Job abgeschlossen ist, haben Sie ein portugiesisches Transkript, nach Sprechern getrennt, das wie folgt lautet:

Sprecher A [00:02]: Então, conta-me como começou o projeto. Sprecher B [00:05]: Começou quase por acaso, no ano passado.

Sie benennen die Sprecher in die tatsächlichen Namen um, exportieren sie in DOCX oder ein anderes Format, und schon sind Sie fertig. Zu keinem Zeitpunkt wurde die Sprache geändert. Das ist eine reine Transkriptionsaufgabe, und das ist der Fall, den der Ausdruck „Audio in Text übersetzen“ meistens beschreibt.

Ändern Sie nun ein Detail. Angenommen, Sie sprechen kein Portugiesisch und benötigen das Vorstellungsgespräch auf Englisch. Bevor Sie den vollständigen Upload starten, wählen Sie Englisch als Übersetzungsziel. Wenn der Auftrag abgeschlossen ist, werden das portugiesische Quelltranskript und das ins Englische übersetzte Transkript als separate Sprachregisterkarten angezeigt, und Sie können beide exportieren.

Wenn Sie wirklich eine Übersetzung benötigen

Wenn Sie Audio in einer Sprache haben, die Sie nicht sprechen, z. B. ein französisches Interview oder eine deutsche Vorlesung oder eine spanische Aufnahme, und Sie den Inhalt auf Englisch haben möchten, ist der gleiche Unterschied immer noch wichtig: Zuerst muss das Audio transkribiert werden, dann der Text kann übersetzt werden.

In Hushscript wählen Sie dies aus, bevor der vollständige Upload beginnt. Behalten Sie die automatische Erkennung der Ausgangssprache bei oder wählen Sie sie selbst aus und fügen Sie dann die gewünschten Zielsprachen hinzu. Die App zeigt die geschätzten abgerechneten Minuten vor dem Hochladen an, da Übersetzungsziele abgerechnete Minuten hinzufügen. Wenn Sie Zielsprachen überspringen, gibt der Job nur das Transkript in derselben Sprache zurück.

Wenn der Job abgeschlossen ist, erhalten Sie das Quelltranskript sowie übersetzte Transkripte als Sprachregisterkarten. Öffnen Sie die Registerkarte, die Sie benötigen, und exportieren Sie diese Sprache in einem der 21 Formate, die Sie benötigen, einschließlich TXT, SRT und DOCX, oder als passwortgeschütztes .husharchive. Wenn der Wortlaut rechtliche, medizinische, journalistische oder publizistische Bedeutung hat, lassen Sie das übersetzte Transkript von einem menschlichen Übersetzer überprüfen, bevor Sie sich darauf verlassen.

Ein praktischer Hinweis zu Exporten: Wählen Sie das Format, das zum nächsten Schritt passt. TXT ist sauber für die reine Textüberprüfung, DOCX oder PDF lassen sich leichter mit anderen teilen, SRT oder VTT sind für Untertitel, CSV und JSON sind nützlich für strukturierte Arbeitsabläufe und Markdown ist praktisch für Notizen oder Veröffentlichungsentwürfe. Sprecherlabels im Transkript sagen den Prüfern, wer spricht, wodurch eine häufige Quelle von Vermutungen in Interviews entfällt.

Um die Grenze klarzustellen: Transkription und Übersetzung sind immer noch unterschiedliche Aufgaben, auch wenn ein Upload beides erfordern kann. Hushscript benötigt zunächst ein Quelltranskript und kann dann vor dem Hochladen das Transkript in der Zielsprache bereitstellen, das Sie ausgewählt haben. Diese Trennung ist nützlich, weil sie Ihnen sagt, was Sie überprüfen müssen, wenn etwas nicht stimmt: das Quelltranskript, die übersetzte Registerkarte oder beides.

Falls Ihre Ausgangssprache außerhalb der von Hushscript unterstützten ungefähr 99 liegt, benötigen Sie für Schritt eins ein anderes Transkriptionstool und übersetzen dann von dort aus.

Warum die Unterscheidung wichtig ist

Die Gleichbehandlung von Transkription und Übersetzung führt zu einigen vorhersehbaren Fehlern.

Laden Sie spanisches Audio hoch, ohne eine Zielsprache auszuwählen, und Sie erhalten spanischen Text, denn genau diesen erzeugt die Transkription. Wählen Sie vor dem Hochladen Englisch aus und Hushscript kann neben dem spanischen Quelltranskript auch ein ins Englische übersetztes Transkript hinzufügen. In jedem Fall hängt die Qualität des endgültigen Englisch von zwei Faktoren ab: wie genau das Spanische transkribiert wurde und wie genau es übersetzt wurde. Ein Fehler im ersten Stadium kann im zweiten immer noch zum Fehler werden.

Deshalb ist die Unterscheidung wichtig. Mit sichtbaren Quellen- und übersetzten Registerkarten können Sie überprüfen, ob ein Problem auf die Transkription oder auf die Sprachänderung zurückzuführen ist. Ein Workflow, der beide Phasen verbirgt, macht dies schwieriger.

Für eine kurze Zusammenfassung, eine kurze informelle E-Mail oder einen ungefähren Eindruck davon, was gesagt wurde, kann maschinelle Übersetzung ausreichen. Für Gerichtsverfahren, Journalismus, formelle Dokumentation oder alles, wo ein falsches Wort eine Rolle spielt, überprüfen Sie das Quelltranskript und lassen Sie den endgültigen Wortlaut von einem menschlichen Übersetzer überprüfen.

Tipps zur Genauigkeit und Qualität

Eine saubere Aufnahme lässt sich in jeder Sprache besser transkribieren, und das ist wichtiger als die Sprache selbst. Halten Sie das Mikrofon in der Nähe des Sprechers, nehmen Sie an einem ruhigen Ort auf und bitten Sie die Teilnehmer, nicht übereinander zu reden. Mikrofonabstand und Hintergrundgeräusche beeinflussen das Ergebnis weitaus stärker als die Frage, in welcher der rund 99 Sprachen Sie arbeiten.

Einsprachige Aufnahmen sind am einfachsten. Wenn ein Sprecher mitten im Satz zwischen zwei Sprachen wechselt, ist dies für die Engine schwieriger zu verstehen und das Transkript kann zwischen den Sprachen hin- und herrutschen. Behalten Sie nach Möglichkeit eine Aufnahme in einer Sprache bei. Wenn ein Gespräch wirklich durchgehend zweisprachig ist, sollten Sie damit rechnen, vor der Übersetzung einige Passagen von Hand durchzulesen und zu korrigieren.

Eigennamen sind einen zweiten Blick wert. Bei den Namen von Personen, Orten und Unternehmen gehen in Transkripten am häufigsten geringfügige Fehler ein, und ein kleiner Ausrutscher kann bei einer späteren Übersetzung zu Problemen führen. Überfliegen Sie das Transkript für diese und korrigieren Sie sie, während das Audio noch in Ihrem Kopf ist, bevor der Text in die Übersetzungsphase übergeht.

Wenn Sie vor dem Hochladen Übersetzungen in die Zielsprache auswählen, setzt die Genauigkeit des Quelltranskripts die Obergrenze für alles, was nachgelagert ist. Der Zeitaufwand für eine saubere Aufnahme und die Überprüfung des Transkripts zahlt sich doppelt aus, denn jedes übersetzte Transkript kann nur so gut sein wie der Quelltext dahinter.

Wählen Sie Ihren Weg

Nutzen Sie diese Option, um schnell eine Entscheidung zu treffen. Wenn Sie den Ton verstehen und ihn aufschreiben möchten, transkribieren Sie ihn und hören Sie dort auf; Du bist fertig. Wenn Sie den Ton nicht verstehen und die Bedeutung in Ihrer Sprache haben möchten, wählen Sie vor dem Hochladen Übersetzungsziele aus und überprüfen Sie dann die Quelle und die übersetzten Registerkarten, wenn der Auftrag abgeschlossen ist. Wenn Sie schnell einen groben Überblick benötigen und die Genauigkeit nicht entscheidend ist, kann eine maschinelle Übersetzung ausreichen. Wenn die Genauigkeit von entscheidender Bedeutung ist, überprüfen Sie das Transkript und lassen Sie den übersetzten Wortlaut von einem Menschen überprüfen.

In jedem dieser Pfade ist der Transkriptionsschritt die Grundlage und es ist der Teil, mit dem Hushscript beginnt: ein Quelltranskript mit getrennten Sprechern in ungefähr 99 Sprachen, das automatisch erkannt oder vor dem Hochladen ausgewählt wird.

In Ihrem Fall ist das übliche, Audio, von dem Sie wissen, dass Sie es aufschreiben möchten, dann ist /audio-to-text das richtige Werkzeug. Legen Sie die Datei ab, sehen Sie sich die ersten 30 Sekunden in der Vorschau an, melden Sie sich an und exportieren Sie das Transkript. Eine Schritt-für-Schritt-Anleitung, die alle Dateitypen abdeckt, finden Sie unter So transkribieren Sie eine beliebige Audiodatei. Und wenn Sie die Technologie verstehen möchten, die Sprache überhaupt in Text umwandelt, erklärt Speech to Text: So funktioniert es es anschaulich.

Unabhängige Quellen und Standards

Hushscript hat diese unabhängigen, nicht konkurrierenden Quellen herangezogen. Sie erläutern Forschung, Standards oder Plattformfunktionen und stellen keine Empfehlung durch Hushscript dar.

Quellen geprüft am:

Häufig gestellte Fragen

Was bedeutet „Audio in Text übersetzen“?

Die meisten Menschen, die nach diesem Begriff suchen, möchten eine Transkription: gesprochenes Audio in geschriebenen Text in derselben Sprache umwandeln. Eine kleinere Gruppe bedeutet Übersetzung, die auch die Sprache verändert. Wenn Ihr Audio in einer Sprache vorliegt, die Sie verstehen, und Sie es nur aufgeschrieben haben möchten, möchten Sie eine Transkription.

Ist Transkription dasselbe wie eine Übersetzung?

Nein. Bei der Transkription wird Sprache in geschriebenen Text in derselben Sprache umgewandelt, sodass gesprochenes Englisch zu geschriebenem Englisch wird. Durch die Übersetzung wird Text von einer Sprache in eine andere umgewandelt, sodass Französisch zu Englisch wird. Es handelt sich um separate Prozesse, die jedoch mit einem einzigen Tool miteinander verkettet werden können.

Kann ich Audio auf Spanisch, Französisch oder Deutsch transkribieren?

Ja. Hushscript transkribiert rund 99 Sprachen und erkennt die Sprache automatisch, sodass Sie sie nie manuell einstellen müssen. Es werden Spanisch, Französisch, Deutsch, Italienisch, Portugiesisch, Japanisch, Mandarin, Hindi und Arabisch abgedeckt. Sie erhalten ein Transkript in derselben Sprache.

Übersetzt Hushscript Audio in eine andere Sprache?

Ja. Wählen Sie vor dem Hochladen Übersetzungsziele aus. Hushscript transkribiert das Quellaudio und fügt übersetzte Transkripte als Sprachregisterkarten hinzu, die Sie pro Sprache exportieren können. Wenn Sie vor dem Hochladen keine Ziele auswählen, gibt der Job ein Transkript in derselben Sprache zurück.

Wie erhalte ich nach der Transkription eine Übersetzung?

Wählen Sie vor dem Hochladen Übersetzungsziele aus. Wenn der Auftrag abgeschlossen ist, öffnen Sie die Registerkarte „Sprache“, die Sie benötigen, und exportieren Sie das übersetzte Transkript. Lassen Sie bei zertifizierten oder veröffentlichungskritischen Formulierungen das Ergebnis von einem menschlichen Übersetzer überprüfen.

Warum nicht ein Tool verwenden, das Audio mit einem Klick übersetzt?

Ein-Klick-Tools transkribieren und dann im Hintergrund maschinell übersetzen, was für einen schnellen Überblick in Ordnung ist. Der Haken daran ist, dass sich Fehler verschlimmern: Ein kleiner Transkriptionsfehler führt dazu, dass der Übersetzer ein falsches Wort erhält und man nicht erkennen kann, wo der Fehler gelaufen ist. Durch die Aufteilung der Schritte können Sie das Transkript vor der Übersetzung überprüfen.

Was passiert, wenn ein Video fremdsprachige Sprache enthält?

Laden Sie das Video hoch und wählen Sie alle Übersetzungen in die Zielsprache aus, bevor der vollständige Upload beginnt. Das Audio wird in Ihrem Browser extrahiert, die Ausgangssprache kann automatisch erkannt werden und übersetzte Transkripte werden nach Abschluss des Auftrags als Sprachregisterkarten angezeigt.

Welches ist genauer für ein Transkript, auf das ich mich verlassen kann?

Transkribieren Sie direkt in der gesprochenen Sprache, anstatt ein Tool spontan mit der Übersetzung zu beauftragen. Ein Transkript in derselben Sprache hat eine Fehlerquelle statt zwei, und Sie können es lesen, um zu bestätigen, dass es richtig ist, bevor Sie es übersetzen oder teilen.

Mit 30 kostenlosen Minuten starten

Starten – 30 kostenlose Minuten