„Audio in Text übersetzen“: Was es eigentlich bedeutet
Autor: Hushscript Veröffentlicht: Zuletzt geprüft:
„Audio in Text übersetzen“ ist ein Suchbegriff, der zwei verschiedene Aufgaben abdeckt. Die meisten Leute, die es tippen, haben Audio in einer Sprache, die sie verstehen, und möchten, dass die Rede aufgeschrieben wird. Eine kleinere Gruppe verfügt über Audioaufnahmen in einer Sprache, die sie nicht sprechen, und möchte die Bedeutung in einer anderen Sprache hören. Die erste Aufgabe ist die Transkription. Die zweite fügt zusätzlich eine Übersetzung hinzu. Zu wissen, welches Sie tatsächlich benötigen, erspart Ihnen viel Verwirrung, da die Werkzeuge und Schritte nicht die gleichen sind.
Diese Anleitung trennt beides, zeigt, wie man Audiodaten transkribiert, die zufällig in einer anderen Sprache vorliegen, und erklärt, was zu tun ist, wenn Sie wirklich eine Übersetzung benötigen. Hushscript kann ein Transkript in derselben Sprache zurückgeben oder das Quellaudio transkribieren und ausgewählte Zielsprachenübersetzungen hinzufügen, wenn Sie diese Ziele vor dem Hochladen auswählen. Die Übersetzung ist Teil der Upload-Optionen und kein nachträglicher Wechsel in der Transkriptansicht.
Transkription versus Übersetzung
Die Transkription wandelt Sprache in Text in derselben Sprache um. Sie haben eine englische Interviewaufzeichnung und erhalten ein englisches Textdokument. Sie haben einen französischen Podcast und erhalten ein französisches Transkript. Die Wörter auf der Seite sind die Wörter, die gesprochen wurden. Nichts ändert die Sprache.
Übersetzung konvertiert Text von einer Sprache in eine andere. Französischer Text wird zu englischem Text. Es funktioniert mit Text, nicht mit Ton, und es muss sowohl die Ausgangssprache als auch die Zielsprache kennen. Die Europäische Kommission trennt Übersetzung von dolmetschen in gesprochener Sprache; Die gleiche Unterscheidung hilft zu erklären, warum sich hinter „Audio in Text übersetzen“ zwei separate Aufgaben verbergen können.
Warum sagen also so viele Leute „übersetzen“, wenn sie „trankribieren“ meinen? Das Wort wird lose verwendet, so wie jemand sagt, er müsse eine PDF-Datei in eine Word-Datei „übersetzen“, obwohl er eigentlich nur das Format konvertieren meint. Der Wechsel von Audio zu Text fühlt sich an, als würde man zwischen zwei Arten von Medien übersetzen, auch wenn sich die Sprache nicht geändert hat. Diese informelle Verwendung ist der Grund dafür, dass dieser Suchbegriff so häufig vorkommt, und deshalb suchen die meisten Leute, die ihn eingeben, nach einem Transkriptionstool.
Eine schnelle Möglichkeit, herauszufinden, welchen Job Sie benötigen: Können Sie die Aufnahme verstehen? Wenn Sie können und es nur aufgeschrieben haben möchten, ist das eine Transkription. Wenn Sie es nicht verstehen und die Bedeutung in Ihrer eigenen Sprache haben möchten, ist das eine Transkription, gefolgt von einer Übersetzung.
Audio in derselben Sprache ist eine Transkription
Wenn Sie eine englische Aufnahme haben und diese als Text haben möchten, ist das eine Transkription. Wenn Sie eine spanische Aufnahme haben und ein spanisches Transkript wünschen, ist das auch eine Transkription. Sie ändern nicht die Sprache. Sie ändern das Format von Ton zu Wörtern auf einer Seite.
Dies ist die häufigste Absicht hinter der Suche und genau dafür wurde Hushscript entwickelt. So funktioniert es, von Anfang bis Ende.
- Legen Sie Ihre Datei unter /audio-to-text ab. Eine 30-sekündige, mit Sprecher gekennzeichnete Vorschau wird direkt im Browser gerendert, ohne dass ein Konto erforderlich ist, sodass Sie die Qualität sehen können, bevor Sie sich auf etwas festlegen.
- Melden Sie sich mit Ihrer E-Mail-Adresse an, um den Rest zu transkribieren. Die ersten 30 Minuten sind einmalig kostenlos. Das Hinzufügen einer Karte ist der schnellste Weg: Durch eine Vormerkung von einem Dollar wird die Karte bestätigt, dann sofort gelöscht und nie belastet. Wenn Sie lieber eine andere in Ihrem Land verfügbare Zahlungsmethode nutzen möchten, erhalten Sie die Freiminuten stattdessen bei Ihrem ersten Einkauf. In beiden Fällen ist keine Karte erforderlich.
- Laden Sie die vollständige Datei hoch. Wenn es sich um ein Video handelt, wird das Audio zuerst in Ihrem Browser extrahiert, sodass das Video selbst auf Ihrem Gerät verbleibt und nur das Audio den Server erreicht.
- Wählen Sie die Transkriptionsoptionen. Belassen Sie die automatische Erkennung der Ausgangssprache oder wählen Sie sie selbst aus. Wählen Sie dann vor dem Hochladen ggf. Übersetzungen in die Zielsprache aus.
- Lesen, neu kennzeichnen und exportieren. Benennen Sie „Sprecher A“ in einen richtigen Namen um und laden Sie dann das Transkript in einem der 21 Exportformate (TXT, SRT, VTT, DOCX, PDF und mehr) oder als passwortgeschütztes .husharchive herunter. Übersetzte Transkripte werden als Sprachregisterkarten angezeigt und können pro Sprache exportiert werden.
Sprecherlabels und Zeitstempel werden unabhängig von der Sprache automatisch zurückgegeben. Wenn Sie vor dem Hochladen keine Übersetzungsziele auswählen, ist das Transkript, das Sie erhalten, in derselben Sprache wie die Audiodatei, da dies bei der Transkription der Fall ist.
Ein funktionierendes Beispiel
Angenommen, Sie zeichnen ein 40-minütiges Interview mit einem Kollegen auf, der Portugiesisch spricht, und Sie verstehen beide Portugiesisch. Sie möchten eine schriftliche Aufzeichnung, aus der Sie später zitieren können.
Sie legen die Datei unter /audio-to-text ab und die Vorschau zeigt die erste halbe Minute, bereits aufgeteilt in Sprecher A und Sprecher B. Die Akzente und das Portugiesisch kommen klar zur Geltung, also melden Sie sich an und laden die gesamte Aufnahme hoch. Wenn der Job abgeschlossen ist, haben Sie ein portugiesisches Transkript, nach Sprechern getrennt, das wie folgt lautet:
Sprecher A [00:02]: Então, conta-me como começou o projeto. Sprecher B [00:05]: Começou quase por acaso, no ano passado.
Sie benennen die Sprecher in die tatsächlichen Namen um, exportieren sie in DOCX oder ein anderes Format, und schon sind Sie fertig. Zu keinem Zeitpunkt wurde die Sprache geändert. Das ist eine reine Transkriptionsaufgabe, und das ist der Fall, den der Ausdruck „Audio in Text übersetzen“ meistens beschreibt.
Ändern Sie nun ein Detail. Angenommen, Sie sprechen kein Portugiesisch und benötigen das Vorstellungsgespräch auf Englisch. Bevor Sie den vollständigen Upload starten, wählen Sie Englisch als Übersetzungsziel. Wenn der Auftrag abgeschlossen ist, werden das portugiesische Quelltranskript und das ins Englische übersetzte Transkript als separate Sprachregisterkarten angezeigt, und Sie können beide exportieren.
Wenn Sie wirklich eine Übersetzung benötigen
Wenn Sie Audio in einer Sprache haben, die Sie nicht sprechen, z. B. ein französisches Interview oder eine deutsche Vorlesung oder eine spanische Aufnahme, und Sie den Inhalt auf Englisch haben möchten, ist der gleiche Unterschied immer noch wichtig: Zuerst muss das Audio transkribiert werden, dann der Text kann übersetzt werden.
In Hushscript wählen Sie dies aus, bevor der vollständige Upload beginnt. Behalten Sie die automatische Erkennung der Ausgangssprache bei oder wählen Sie sie selbst aus und fügen Sie dann die gewünschten Zielsprachen hinzu. Die App zeigt die geschätzten abgerechneten Minuten vor dem Hochladen an, da Übersetzungsziele abgerechnete Minuten hinzufügen. Wenn Sie Zielsprachen überspringen, gibt der Job nur das Transkript in derselben Sprache zurück.
Wenn der Job abgeschlossen ist, erhalten Sie das Quelltranskript sowie übersetzte Transkripte als Sprachregisterkarten. Öffnen Sie die Registerkarte, die Sie benötigen, und exportieren Sie diese Sprache in einem der 21 Formate, die Sie benötigen, einschließlich TXT, SRT und DOCX, oder als passwortgeschütztes .husharchive. Wenn der Wortlaut rechtliche, medizinische, journalistische oder publizistische Bedeutung hat, lassen Sie das übersetzte Transkript von einem menschlichen Übersetzer überprüfen, bevor Sie sich darauf verlassen.
Ein praktischer Hinweis zu Exporten: Wählen Sie das Format, das zum nächsten Schritt passt. TXT ist sauber für die reine Textüberprüfung, DOCX oder PDF lassen sich leichter mit anderen teilen, SRT oder VTT sind für Untertitel, CSV und JSON sind nützlich für strukturierte Arbeitsabläufe und Markdown ist praktisch für Notizen oder Veröffentlichungsentwürfe. Sprecherlabels im Transkript sagen den Prüfern, wer spricht, wodurch eine häufige Quelle von Vermutungen in Interviews entfällt.
Um die Grenze klarzustellen: Transkription und Übersetzung sind immer noch unterschiedliche Aufgaben, auch wenn ein Upload beides erfordern kann. Hushscript benötigt zunächst ein Quelltranskript und kann dann vor dem Hochladen das Transkript in der Zielsprache bereitstellen, das Sie ausgewählt haben. Diese Trennung ist nützlich, weil sie Ihnen sagt, was Sie überprüfen müssen, wenn etwas nicht stimmt: das Quelltranskript, die übersetzte Registerkarte oder beides.
Falls Ihre Ausgangssprache außerhalb der von Hushscript unterstützten ungefähr 99 liegt, benötigen Sie für Schritt eins ein anderes Transkriptionstool und übersetzen dann von dort aus.
Warum die Unterscheidung wichtig ist
Die Gleichbehandlung von Transkription und Übersetzung führt zu einigen vorhersehbaren Fehlern.
Laden Sie spanisches Audio hoch, ohne eine Zielsprache auszuwählen, und Sie erhalten spanischen Text, denn genau diesen erzeugt die Transkription. Wählen Sie vor dem Hochladen Englisch aus und Hushscript kann neben dem spanischen Quelltranskript auch ein ins Englische übersetztes Transkript hinzufügen. In jedem Fall hängt die Qualität des endgültigen Englisch von zwei Faktoren ab: wie genau das Spanische transkribiert wurde und wie genau es übersetzt wurde. Ein Fehler im ersten Stadium kann im zweiten immer noch zum Fehler werden.
Deshalb ist die Unterscheidung wichtig. Mit sichtbaren Quellen- und übersetzten Registerkarten können Sie überprüfen, ob ein Problem auf die Transkription oder auf die Sprachänderung zurückzuführen ist. Ein Workflow, der beide Phasen verbirgt, macht dies schwieriger.
Für eine kurze Zusammenfassung, eine kurze informelle E-Mail oder einen ungefähren Eindruck davon, was gesagt wurde, kann maschinelle Übersetzung ausreichen. Für Gerichtsverfahren, Journalismus, formelle Dokumentation oder alles, wo ein falsches Wort eine Rolle spielt, überprüfen Sie das Quelltranskript und lassen Sie den endgültigen Wortlaut von einem menschlichen Übersetzer überprüfen.
Tipps zur Genauigkeit und Qualität
Eine saubere Aufnahme lässt sich in jeder Sprache besser transkribieren, und das ist wichtiger als die Sprache selbst. Halten Sie das Mikrofon in der Nähe des Sprechers, nehmen Sie an einem ruhigen Ort auf und bitten Sie die Teilnehmer, nicht übereinander zu reden. Mikrofonabstand und Hintergrundgeräusche beeinflussen das Ergebnis weitaus stärker als die Frage, in welcher der rund 99 Sprachen Sie arbeiten.
Einsprachige Aufnahmen sind am einfachsten. Wenn ein Sprecher mitten im Satz zwischen zwei Sprachen wechselt, ist dies für die Engine schwieriger zu verstehen und das Transkript kann zwischen den Sprachen hin- und herrutschen. Behalten Sie nach Möglichkeit eine Aufnahme in einer Sprache bei. Wenn ein Gespräch wirklich durchgehend zweisprachig ist, sollten Sie damit rechnen, vor der Übersetzung einige Passagen von Hand durchzulesen und zu korrigieren.
Eigennamen sind einen zweiten Blick wert. Bei den Namen von Personen, Orten und Unternehmen gehen in Transkripten am häufigsten geringfügige Fehler ein, und ein kleiner Ausrutscher kann bei einer späteren Übersetzung zu Problemen führen. Überfliegen Sie das Transkript für diese und korrigieren Sie sie, während das Audio noch in Ihrem Kopf ist, bevor der Text in die Übersetzungsphase übergeht.
Wenn Sie vor dem Hochladen Übersetzungen in die Zielsprache auswählen, setzt die Genauigkeit des Quelltranskripts die Obergrenze für alles, was nachgelagert ist. Der Zeitaufwand für eine saubere Aufnahme und die Überprüfung des Transkripts zahlt sich doppelt aus, denn jedes übersetzte Transkript kann nur so gut sein wie der Quelltext dahinter.
Wählen Sie Ihren Weg
Nutzen Sie diese Option, um schnell eine Entscheidung zu treffen. Wenn Sie den Ton verstehen und ihn aufschreiben möchten, transkribieren Sie ihn und hören Sie dort auf; Du bist fertig. Wenn Sie den Ton nicht verstehen und die Bedeutung in Ihrer Sprache haben möchten, wählen Sie vor dem Hochladen Übersetzungsziele aus und überprüfen Sie dann die Quelle und die übersetzten Registerkarten, wenn der Auftrag abgeschlossen ist. Wenn Sie schnell einen groben Überblick benötigen und die Genauigkeit nicht entscheidend ist, kann eine maschinelle Übersetzung ausreichen. Wenn die Genauigkeit von entscheidender Bedeutung ist, überprüfen Sie das Transkript und lassen Sie den übersetzten Wortlaut von einem Menschen überprüfen.
In jedem dieser Pfade ist der Transkriptionsschritt die Grundlage und es ist der Teil, mit dem Hushscript beginnt: ein Quelltranskript mit getrennten Sprechern in ungefähr 99 Sprachen, das automatisch erkannt oder vor dem Hochladen ausgewählt wird.
In Ihrem Fall ist das übliche, Audio, von dem Sie wissen, dass Sie es aufschreiben möchten, dann ist /audio-to-text das richtige Werkzeug. Legen Sie die Datei ab, sehen Sie sich die ersten 30 Sekunden in der Vorschau an, melden Sie sich an und exportieren Sie das Transkript. Eine Schritt-für-Schritt-Anleitung, die alle Dateitypen abdeckt, finden Sie unter So transkribieren Sie eine beliebige Audiodatei. Und wenn Sie die Technologie verstehen möchten, die Sprache überhaupt in Text umwandelt, erklärt Speech to Text: So funktioniert es es anschaulich.
Unabhängige Quellen und Standards
Hushscript hat diese unabhängigen, nicht konkurrierenden Quellen herangezogen. Sie erläutern Forschung, Standards oder Plattformfunktionen und stellen keine Empfehlung durch Hushscript dar.
Quellen geprüft am: