Zum Inhalt springen
Dokumentation durchsuchen

Transkriptionsgenauigkeit

Verbessern Sie schlechte Genauigkeit, falsch erkannte Sprachen oder fehlende Wörter.

Wenn Ihr Transkript falsch verstandene Wörter, die falsche Sprache, fehlende Namen oder durcheinandergebrachte Sprecher enthält, lässt sich die Genauigkeit fast immer auf einige wenige behebbare Ursachen zurückführen: die Audioqualität, die bei der Engine ankommt, die Hinweise, die Sie ihr geben, und die Art, wie sich Sprache im Raum überlagert. Diese Seite führt Sie durch jede dieser Ursachen und die jeweils schnellste Lösung.

Die meisten Genauigkeitsprobleme lassen sich lösen, bevor Sie auf Aufnehmen drücken. Wählen Sie dazu den richtigen Audiomodus, fügen Sie erwartete Sprachen als Hinweise hinzu und geben Sie Kalima ein wenig Kontext zu Namen und Fachbegriffen. Verwenden Sie die folgende Checkliste, um zu diagnostizieren, was Sie beobachten.

Hier starten: eine schnelle Checkliste

Sauberes Audio
Wählen Sie den richtigen Qualitätsmodus und ein gutes Mikrofon, damit die Engine klare Sprache hört.
Sprachhinweise
Sagen Sie Kalima, welche Sprachen zu erwarten sind, damit es nicht mehr raten muss.
Sitzungskontext
Geben Sie Namen und Fachbegriffe vorab ein, damit Spezialbegriffe korrekt erkannt werden.
Jeweils eine Stimme
Sich überlagernde Sprache ist der schwierigste Fall für jede Transkriptions-Engine.
Idee

Der größte einzelne Hebel für die Genauigkeit ist ein sauberes Eingangssignal. Ein anständiges Mikrofon nah am Sprecher in einem ruhigen Raum mit dem richtigen Qualitätsmodus übertrifft jede nachträgliche Korrektur. Sorgen Sie zuerst für gutes Audio und fügen Sie danach Hinweise und Kontext hinzu.

Diagnose nach Symptom

Hintergrundgeräusche, Echo und ein weit entferntes Mikrofon sind die häufigsten Ursachen für verstümmelten Text. Kalima bietet zwei Aufnahmequalitätsmodi:

  • Optimiert aktiviert Echounterdrückung, Rauschunterdrückung und automatische Aussteuerung. Der Modus ist die Voreinstellung und hilft bei einem Laptop-Mikrofon sowie in lauten oder halligen Räumen viel.
  • Unverarbeitet nimmt das Audio unbearbeitet auf und eignet sich am besten mit einem guten Mikrofon in einem ruhigen Raum.

Wenn Ihr Transkript verstümmelt ist, prüfen Sie, ob der Qualitätsmodus zu dem Raum passt, in dem Sie sich tatsächlich befinden. Optimiert ist für fast jeden Raum die sicherere Wahl. Sie können beide an einer Probe mit der Option Modi testen in den Audioeinstellungen vergleichen. Rücken Sie außerdem näher an das Mikrofon und halten Sie einen gleichbleibenden Abstand. Eine vollständige Aufschlüsselung finden Sie unter Audioquellen & Qualität.

Kalima erkennt die Sprache automatisch, aber die Erkennung ist geführt, nicht erzwungen. Sie kann bei Akzenten, kurzen Phrasen oder ähnlich klingenden Sprachen ins Stocken geraten. Die Lösung besteht darin, erwartete Sprachen als Hinweise hinzuzufügen.

Suchen Sie im Schritt Sprachen des Einrichtungsassistenten (oder in Ihren Sitzungseinstellungen) nach jeder erwarteten Sprache und fügen Sie sie hinzu. Das lenkt die Erkennung in Richtung dieser Sprachen, ohne andere auszuschließen, sodass Sprachwechsel mitten im Gespräch weiterhin funktionieren. Mindestens einen Hinweis hinzuzufügen verbessert die Ergebnisse deutlich, wenn Sie bereits wissen, was gesprochen wird.

Die Auswahl bietet rund 60 Sprachen, und Sie können mehrere davon hinzufügen. Erfahren Sie mehr unter Sprachen & Erkennung.

Die allgemeine Erkennung verfehlt oft Personennamen, Firmen- und Produktnamen, medizinische oder juristische Begriffe und sonstigen Fachjargon. Geben Sie Kalima dieses Vokabular vorab über den Sitzungskontext mit.

Öffnen Sie den Dialog für den Sitzungskontext (oder den Schritt Kontext in der Einrichtung) und fügen Sie eine kurze Beschreibung der Sitzung sowie die spezifischen Begriffe und Namen hinzu, die Sie erwarten. Das verbessert die Erkennung genau dieser Wörter. Das Feld für die Kurzbeschreibung fasst bis zu 2.000 Zeichen, halten Sie es aber knapp, denn sehr lange Hintergründe bringen abnehmenden Nutzen. Sie können auch wiederverwendbare Kontextvorlagen für wiederkehrende Besprechungstypen speichern. Eine vollständige Anleitung finden Sie unter Genauigkeit mit Kontext verbessern.

Kalima trennt Sprecher automatisch (Sprecher 1, Sprecher 2 und so weiter), aber sich überlagernde oder sehr kurze Sprache ist für jede Engine der schwierigste Fall, sodass gelegentlich eine Zeile falsch zugeordnet werden kann. Um das zu reduzieren:

  • Ermutigen Sie dazu, dass jeweils nur eine Person spricht, denn Durcheinanderreden ist die Hauptursache für falsche Zuordnungen.
  • Stellen Sie sicher, dass jeder Sprecher für das Mikrofon klar hörbar ist.

Sobald die Aufnahme gestoppt ist, können Sie Sprecher in echte Namen umbenennen, und die Nummerierung bleibt über jede Aufnahme der Sitzung hinweg einheitlich. Siehe Sprecher & Diarisierung.

Wenn Sie weit vom Mikrofon entfernt sitzen oder ein leises Ansteckmikrofon verwenden, hört die Engine Sie möglicherweise nicht deutlich. Passen Sie die Aufnahmeverstärkung an, bevor Sie aufnehmen: Öffnen Sie die Verstärkungseinstellungen (das Zahnrad neben der Audioquelle) und heben oder senken Sie den Pegel. Der Bereich reicht von -12 dB bis +12 dB in Schritten von 1 dB, Standardwert 0, und Ihre Einstellung wird für das nächste Mal gespeichert. Erhöhen Sie ihn für leise Mikrofone und senken Sie ihn bei zu lautem, verzerrtem Eingangssignal.

Das ist zu erwarten und kein Genauigkeitsproblem. Die Live-Transkription zeigt zuerst ein schnelles vorläufiges Ergebnis und verfeinert es einen Moment später zur bestätigten Version. Bestätigter Text kann dem Live-Audio um bis zu etwa 2 Sekunden hinterherhängen, während die Engine jede Phrase abschließt. Diese kurze Verzögerung verbessert tatsächlich die endgültige Formulierung, da abgehackte, überfragmentierte Ergebnisse vermieden werden.

Kalima zeigt über eine dezente Transparenz an, wie sicher sich die Engine bei jedem Wort ist. Blassere Wörter weisen auf geringere Sicherheit hin und sind einen zweiten Blick wert. Behandeln Sie es als Korrekturhinweis, nicht als Garantie. Blasse Wörter, die gehäuft auftreten, deuten meist auf eine verrauschte Audiopassage hin. Verwenden Sie für die nächste Aufnahme die oben genannten Lösungen (Qualitätsmodus, Mikrofonabstand, Verstärkung) und bereinigen Sie das aktuelle Transkript mit AutoCorrect+ (unten).

Kalima erfasst Audio ab dem Moment, in dem Sie auf Aufnehmen drücken, und puffert es, sodass das kurze Zeitfenster, bevor die Verbindung vollständig hergestellt ist, minimiert wird. Wenn Sie dennoch abgeschnittene erste Wörter bemerken, halten Sie nach dem Drücken auf Aufnehmen etwa eine halbe Sekunde inne, bevor Sie zu sprechen beginnen.

Ein vorhandenes Transkript bereinigen

Die obigen Lösungen verbessern künftige Aufnahmen. Für ein bereits vorhandenes Transkript verwenden Sie AutoCorrect+ (Markieren & Korrigieren), um genau die Fehler zu beheben, auf die es ankommt.

1
Wählen Sie im Transkript das falsch verstandene Wort oder die Phrase aus oder klicken Sie mit der rechten Maustaste darauf und markieren Sie es mit einer Kategorie (falsches Wort, Name/Begriff, Grammatik, Zeichensetzung, zu entfernendes Füllwort oder eine Notiz).
2
Öffnen Sie das Bedienfeld AutoCorrect+ (Markieren & Korrigieren), um alle Ihre offenen Markierungen zu sehen.
3
Geben Sie für jede Markierung die Korrektur selbst ein oder lassen Sie sich von der KI einen Vorschlag machen und wenden Sie ihn dann an.
4
Setzen Sie bei einem wiederkehrenden Namen oder Begriff das Häkchen bei „auch andere korrigieren“. Die KI prüft dann jedes weitere Vorkommen und ersetzt nur die, die wirklich derselbe Fehler sind.

Korrekturen werden auf Wortebene angewendet, sodass das Wiedergabe-Timing und die wortweise Hervorhebung ausgerichtet bleiben. Alle Details finden Sie unter AutoCorrect+ (Markieren & Korrigieren).

Hinweis

AutoCorrect+ verwendet KI und wird auf Ihr wöchentliches Kontingent an Autokorrekturen angerechnet. KI-Korrekturen sind bewusst minimal und fügen keine Wörter hinzu, die nie gesprochen wurden. Wenn eine Transkriptpassage schlicht zu verrauscht war, ist eine erneute Aufnahme mit besserem Audio besser als eine Korrektur Wort für Wort.

Wenn die Genauigkeit in der Nähe einer Verbindungsunterbrechung schlechter aussieht

Wenn ein Abschnitt des Transkripts als wiederhergestellt oder verspätet eingetroffen markiert ist, wurde er nach einer Netzwerkunterbrechung durch Kalimas Lückenwiederherstellung ergänzt und nicht live transkribiert. Dieser wiederhergestellte Text verwendet dieselben Sprachen, dieselbe Übersetzung und denselben Kontext wie Ihre Live-Sitzung und wird an der richtigen Stelle zusammengeführt. Wenn eine Lücke als fehlgeschlagen angezeigt wird, verwenden Sie die Option zum erneuten Versuch. Weitere Informationen finden Sie unter Verbindungs- & Wiederherstellungsprobleme.

Immer noch schlechte Genauigkeit?

Wenn Sie ein gutes Mikrofon, den richtigen Qualitätsmodus, erwartete Sprachen als Hinweise und Sitzungskontext eingerichtet haben und die Genauigkeit weiterhin schlecht ist, liegt das Problem meist am Quellaudio selbst, etwa starke Hintergrundgeräusche, weit entfernte Mikrofone oder mehrere Personen, die durcheinanderreden. Nehmen Sie nach Möglichkeit unter saubereren Bedingungen erneut auf und wenden Sie sich an den Support mit Ihrem Mikrofonmodell, dem Browser oder der Desktop-App und einem kurzen Beispiel, wenn Sie eine genauere Prüfung wünschen.

Verwandte Hilfe