Hedy-Transkripte verstehen

Der Hedy-Transkriptionsunterschied
Als wir Hedy entwickelt haben, wussten wir, dass herkömmliche Transkriptionsmethoden nicht ausreichen. Die meisten Apps nehmen Ihr Audio auf und senden es an entfernte Server, was Ihre Privatsphäre gefährdet. Wir haben einen grundlegend anderen Ansatz gewählt: Hedy verarbeitet Sprache lokal auf Ihrem Gerät in Echtzeit. Standardmäßig wird Audio nie gespeichert — es existiert nur für einen kurzen Moment im Arbeitsspeicher Ihres Geräts während der Verarbeitung und wird danach sofort verworfen. Nur das resultierende Texttranskript wird aufbewahrt.
Lokale Verarbeitung: Ihre Gespräche, Ihre Kontrolle
Hedy führt die Spracherkennung vollständig auf Ihrem Gerät durch. Das ist nicht nur ein Feature — es ist ein grundlegendes Umdenken, wie Gesprächstechnologie funktionieren sollte. Standardmäßig gilt:
-
Audio wird nicht gespeichert. Hedy speichert keine Aufnahmen Ihrer Gespräche. Audiodaten werden nur vorübergehend im RAM gehalten, für den kurzen Moment, der nötig ist, um Sprache in Text umzuwandeln, und dann sofort verworfen.
-
Audio wird nie an Hedy-Server gesendet. Die Sprachverarbeitung findet standardmäßig lokal auf Ihrem Gerät statt, sodass keine Audiodaten zu uns gelangen. Die Ausnahmen aktivieren Sie selbst: ein Cloud-Transkriptionsanbieter, für den Sie Ihren eigenen API-Schlüssel hinterlegen, und iCloud Audio Sync, das gespeichertes Audio in Ihr eigenes iCloud-Konto kopiert.
-
Nur Text wird aufbewahrt. Was Hedy behält, ist das resultierende Transkript — eine Textdarstellung des Gesprächs, nicht das Audio selbst.
Wenn Sie Ihr Audio für eine spätere Überprüfung aufbewahren möchten, können Sie das Speichern von Audio in Ihren Sitzungseinstellungen aktivieren. Wenn diese Option aktiviert ist, speichert Hedy die Audioaufnahme lokal auf Ihrem Gerät neben dem Transkript. Auch dann gelangt sie nie auf unsere Server. Auf Apple-Geräten können Sie zusätzlich iCloud Audio Sync aktivieren, das die Datei in Ihr eigenes iCloud-Konto kopiert, damit Sie sie auf Ihren anderen Apple-Geräten abspielen können.
Datenschutz ist kein nachträglicher Gedanke, sondern unser Kernprinzip. Die Spracherkennung läuft auf dem Gerät und Audiodaten werden standardmäßig verworfen. Die Cloud-KI-Analyse verarbeitet Transkriptinhalte standardmäßig im Arbeitsspeicher. Mit Local AI Processing kann die gesamte Verarbeitungskette auf Ihrem Gerät bleiben.
Audio-Datenschutz & Einwilligungsaspekte
Viele Aufnahme- und Transkriptionsgesetze — wie Zwei-Parteien-Einwilligungsgesetze in bestimmten US-Bundesstaaten oder die DSGVO in Europa — befassen sich speziell mit der Aufnahme und Speicherung von Audio. Wenn die Audiospeicherung deaktiviert ist (Standardeinstellung), gilt für Hedy:
-
Es werden keine Audiodateien aufgenommen oder gespeichert
-
Audiodaten werden nur im flüchtigen Speicher (RAM) für die Sekunden gehalten, die zur Verarbeitung nötig sind
-
Es werden keine Audiodaten an Server oder Dritte übermittelt
Das bedeutet, dass die Einwilligungsanforderungen, die für Hedy gelten, sich von denen unterscheiden können, die für Tools gelten, die Audio aufnehmen und speichern. Das von Hedy generierte Texttranskript wird standardmäßig auf Ihrem Gerät gespeichert. Wenn Cloud Sync aktiviert ist, wird es zusätzlich verschlüsselt mit der Cloud synchronisiert. Die Cloud-KI-Analyse verarbeitet Transkriptinhalte vorübergehend, sofern Sie nicht Local AI Processing verwenden.
Wenn Sie die Audiospeicherung aktivieren, wird das Gespräch-Audio lokal auf Ihrem Gerät gespeichert. In diesem Fall können die gleichen Einwilligungsanforderungen gelten, die für jedes Audioaufnahme-Tool gelten.
Datenschutz- und Aufnahmegesetze variieren je nach Rechtsgebiet. Wir empfehlen Nutzern, sich mit den lokalen Vorschriften vertraut zu machen. Diese Informationen dienen der Transparenz und stellen keine Rechtsberatung dar.
Echtzeit-Transkription: Die technische Herausforderung
Die Erstellung genauer, sofortiger Transkripte auf einem mobilen Gerät ist äußerst komplex. Hedy muss drei kritische Faktoren ausbalancieren:
-
Verarbeitungsgeschwindigkeit
-
Recheneffizienz
-
Genauigkeit der Spracherkennung
Unser Ansatz priorisiert sofortige Erkenntnisse. Das bedeutet, dass das Transkript, das Sie sehen, ein lebendiges, sich entwickelndes Dokument ist — es erfasst den Kern Ihres Gesprächs, während es stattfindet.
Transkript-Eigenschaften verstehen
Von Hedy generierte Transkripte sind einzigartig. Sie sind nicht als perfekte gerichtsfeste Aufzeichnungen gedacht, sondern als dynamische, KI-gestützte Gesprächserfassungen. Ihnen könnten auffallen:
-
Gelegentliche Zeichensetzungsvariationen
-
Leichte Unterschiede in der Wortwahl
-
Informelle Formatierung, die den Gesprächsfluss einfängt
Stellen Sie sich Hedys Transkript wie einen erfahrenen Protokollführer vor, der den Geist des Gesprächs erfasst, nicht wie eine stenografische Maschine.
Sprechernamen in Ihrem Transkript
Sitzungen, die Stimmen getrennt erfassen, zeigen über dem Transkript eine Reihe von Sprecher-Chips. Jeder Chip steht für einen von Hedy erkannten Sprecher. Tippen Sie auf einen Chip, um diesem Sprecher einen echten Namen zu geben. Das Transkript, die Sprecherliste und alle Inhalte, die Sie aus der Sitzung exportieren, verwenden diesen Namen von da an.
Hedy versucht auch, die Namen für Sie herauszufinden. Wenn jemand sich vorstellt oder eine andere teilnehmende Person jemanden mit Namen anspricht, gilt das als Hinweis und der Name wird automatisch übernommen. Ihre Kalendereinladung und der Themenkontext helfen Hedy, die richtige Person zuzuordnen. Wenn die Hinweise nicht ausreichen, bleibt der Sprecher nummeriert, statt dass Hedy rät. Daher ist es normal, dass einige Sprecher einen Namen erhalten und andere nicht.
Ein von Ihnen eingegebener Name wird nie überschrieben. Hedys eigene Erkennung ergänzt nur Namen von Sprechern, die Sie nicht selbst benannt haben.
Namen bleiben mit der Sitzung verbunden. Sie erscheinen in Kopien, Freigaben, Downloads und Exporten und werden mit Ihren anderen Geräten synchronisiert. Die Transkriptbereinigung verwendet die von Ihnen bestätigten Namen, sodass in einem bereinigten Transkript echte Personen genannt werden.
Wenn Sie einen Sprecher umbenennen, werden bereits erstellte Zusammenfassungen oder detaillierte Notizen nicht neu geschrieben. Hedy erinnert Sie daran, Zusammenfassung aktualisieren oder Notizen aktualisieren auszuführen, wenn Sie diese Inhalte mit den neuen Namen erneuern möchten.
Wenn die Chips nicht angezeigt werden
Die Sprecherliste setzt ein Transkript mit getrennten Sprecherabschnitten voraus, und nur die Nemotron-Sprach-Engine erzeugt solche Abschnitte. Sie ist verfügbar auf:
- Apple Silicon Macs
- iPhone 12 und neuer
- iPad Air 4 und neuer
- Windows
- 64-Bit-Android-Smartphones
Mit Whisper oder einem Cloud-Sprachanbieter erfasste Sitzungen enthalten keine Sprecherabschnitte und zeigen daher keine Chips. Dies ist eine Eigenschaft der Sitzung und keine Einstellung, die Sie nachträglich aktivieren können. Eine Sitzung, die bereits mit einer anderen Engine erfasst wurde, erhält keine Sprecherliste.
Die Web-App kann selbst keine Nemotron-Sitzung erfassen. Bei Sitzungen, die von einem anderen Gerät synchronisiert wurden, zeigt sie die Chips jedoch an und lässt Sie die Sprecher umbenennen.
Wenn das Umbenennen nicht verfügbar ist
Die Chips werden angezeigt, können aber nicht bearbeitet werden, wenn:
- die Sitzung von jemand anderem mit Ihnen geteilt wurde
- die Sitzung noch läuft; beenden Sie sie daher zuerst
- Sie die bereinigte Version ansehen. Wechseln Sie mit dem Glitzerschalter zurück zu Original, benennen Sie den Sprecher dort um und wechseln Sie anschließend wieder zurück
Ihr Transkript bereinigen
Wenn Sie eine ausgefeiltere Version eines Transkripts möchten — zum Teilen, Exportieren oder einfach zum leichteren Lesen — kann Hedy auf Anfrage eine bereinigte Kopie erstellen. Öffnen Sie eine beliebige abgeschlossene Sitzung, wechseln Sie zum Tab Transkript und tippen Sie auf die Schaltfläche Transkript bereinigen (das Sterne-Symbol, ✨ – leicht zu übersehen). Das Originaltranskript wird nie überschrieben; die bereinigte Version wird daneben gespeichert, und Sie können jederzeit zwischen beiden wechseln.
Zu viele Sprecher? Transkript bereinigen behebt das
Hedy kennzeichnet Sprecher automatisch während der Transkription und ordnet die Stimmen, die es hört, separaten Sprechern zu. Bei längeren Gesprächen oder wenn Hintergrundgeräusche oder Echo vorhanden sind, kann es zu viele Sprecher zählen und eine Person in mehrere aufteilen. Eine Sitzung mit zwei Personen kann am Ende fünf oder mehr Sprecher anzeigen. Mit der Sitzung ist nichts falsch, und Sie müssen die Bezeichnungen nicht Zeile für Zeile ändern. Transkript bereinigen auszuführen ist die Lösung: Es liest die ganze Sitzung erneut und führt die Stimmen wieder zusammen, sodass zu viele Sprecher, eine falsche Anzahl von Sprechern, falsche Sprecherbezeichnungen oder eine Stimme, die in mehrere Sprecher aufgeteilt wurde, in einem Durchlauf bereinigt werden.
Bevor Sie es ausführen, öffnen Sie die Sitzung und prüfen Sie die Notizen. Die Bereinigung liest die Zusammenfassung und die detaillierten Notizen Ihrer Sitzung, um zu ermitteln, wer gesprochen hat. Wenn dort die tatsächlichen Teilnehmer klar benannt sind, kann die bereinigte Kopie Personen mit ihren echten Namen kennzeichnen, statt auf “Sprecher 1” und “Sprecher 2” zurückzufallen. Es lohnt sich also, sicherzustellen, dass Ihre Zusammenfassung oder Ihre Notizen alle Personen nennen, bevor Sie auf Transkript bereinigen tippen.
Wenn die bereinigte Kopie weiterhin bei der falschen Sprecheranzahl landet, ist das zu erwarten: Die Bereinigung ist KI-generiert und liegt nicht jedes Mal exakt richtig. Korrigieren Sie die Namen in Ihren Notizen oder in Ihrer Zusammenfassung, und führen Sie dann Transkript bereinigen erneut aus, um aus dem aktualisierten Kontext eine neue Kopie zu generieren.
Bei einer Bereinigung führt Hedys KI Folgendes aus:
-
Korrigiert Rechtschreibung, Zeichensetzung und Grammatik, ohne zu verändern, was gesagt wurde
-
Fügt Sprecherbezeichnungen hinzu — zuerst mit den Namen, die Sie auf den Sprecher-Chips bestätigt haben, dann mit den echten Namen der Teilnehmer, wenn Ihre Sitzungszusammenfassung oder Notizen sie identifizieren, andernfalls mit “Sprecher 1”, “Sprecher 2” usw.
-
Verbessert die Lesbarkeit insgesamt durch Absatzumbrüche und klarere Formulierungen und entfernt einzelne Markierungen wie
[Music]oder>> -
Wendet Ihr benutzerdefiniertes Vokabular an, damit Unternehmensnamen, Produktbegriffe und technischer Fachjargon korrekt geschrieben werden
-
Übersetzt das bereinigte Transkript optional im selben Schritt in eine andere Sprache — wählen Sie im Bereinigungsdialog eine Zielsprache aus oder lassen Sie die Einstellung auf “Originalsprache beibehalten”
Sobald eine Sitzung eine bereinigte Version hat, wechselt ein Umschalter in der Transkriptansicht (das Glitzersymbol) zwischen Original und Bereinigt. Ein Banner mit der Meldung “Bereinigtes Transkript wird angezeigt” erscheint immer dann, wenn Sie die bereinigte Ansicht geöffnet haben.
Die Transkriptbereinigung verwendet ein Cloud-KI-Modell und läuft auf dem Gerät, das die Sitzung erfasst hat. Sie können keine Bereinigung für eine Sitzung auslösen, die von einem anderen Gerät zu Ihnen synchronisiert oder mit Ihnen geteilt wurde — nur die ursprüngliche Besitzerin oder der ursprüngliche Besitzer kann ein Transkript auf dem ursprünglichen Gerät bereinigen.
Um Transkripttext manuell zu bearbeiten, wechseln Sie zurück zur Originalansicht. Bearbeitung ist nur am Rohtranskript verfügbar, damit Ihre wortgetreue Referenzquelle intakt bleibt. Nach der Bearbeitung können Sie die Bereinigung erneut ausführen, um aus Ihren Korrekturen eine neue bereinigte Kopie zu generieren.
Sprache und Genauigkeit
Wir arbeiten kontinuierlich daran, die Transkription über verschiedene Sprachen hinweg zu verbessern. Derzeit bietet Englisch das ausgereifteste Erlebnis, aber wir erweitern und verfeinern ständig unsere lokalen Verarbeitungsfähigkeiten. Mit zunehmend leistungsfähigeren Mobilprozessoren wird auch unsere Transkription immer ausgefeilter.
Ihre Transkriptqualität verbessern
Während Hedy hart daran arbeitet, Ihre Gespräche zu erfassen, können Sie unterstützen:
-
Sprechen Sie deutlich und in moderatem Tempo
-
Minimieren Sie Hintergrundgeräusche
-
Positionieren Sie Ihr Gerät optimal
Wenn Transkripte weiterhin unverständlich oder unvollständig sind, lesen Sie, wie Sie schlechte Transkriptionsqualität beheben. Wenn eine abgeschlossene Sitzung zu viele Sprecher anzeigt, ist das eine Aufgabe für die Bereinigung und kein Problem bei der Erfassung: siehe den Abschnitt Ihr Transkript bereinigen oben.
Hintergrundgeräusche, mehrere gleichzeitig sprechende Personen und komplexe Audioumgebungen können selbst die fortschrittlichste Spracherkennung herausfordern.
Ihre Transkripte abrufen und verwenden
Hedy macht Ihre Transkripte leicht zugänglich:
-
In Echtzeit während Sitzungen anzeigen
-
Vergangene Sitzungen überprüfen
-
Teilen oder exportieren für weiterführende Analyse
-
Integriert mit KI-Erkenntnissen und Highlights
Die Zukunft der lokalen Transkription
Wir stehen erst am Anfang. Unsere Roadmap umfasst:
-
Erweiterung der Sprachunterstützung
-
Verbesserung der Verarbeitungsalgorithmen
-
Erhöhung der Echtzeit-Genauigkeit
-
Reduzierung des Rechenaufwands