Aller au contenu

Comprendre les transcriptions Hedy

Vue de la transcription Hedy montrant le texte de la conversation transcrite

La différence de transcription Hedy

Lorsque nous avons conçu Hedy, nous savions que les méthodes de transcription traditionnelles étaient insuffisantes. La plupart des applications enregistrent votre audio et l’envoient à des serveurs distants, compromettant votre vie privée. Nous avons adopté une approche radicalement différente : Hedy traite la parole localement sur votre appareil en temps réel. Par défaut, l’audio n’est jamais sauvegardé — il n’existe que temporairement dans la mémoire de votre appareil pendant le traitement et est immédiatement supprimé ensuite. Seule la transcription textuelle résultante est conservée.

Traitement local : Vos conversations, votre contrôle

Hedy effectue la reconnaissance vocale entièrement sur votre appareil. Ce n’est pas simplement une fonctionnalité — c’est une réinvention fondamentale du fonctionnement de la technologie conversationnelle. Par défaut :

  • L’audio n’est pas stocké. Hedy ne sauvegarde pas les enregistrements de vos conversations. Les données audio sont conservées temporairement en RAM uniquement pendant le bref instant nécessaire à la conversion de la parole en texte, puis immédiatement supprimées.

  • L’audio n’est jamais envoyé aux serveurs de Hedy. Le traitement vocal se fait localement sur votre appareil par défaut, donc aucune donnée audio ne nous parvient. Les exceptions, c’est vous qui les activez : un fournisseur de transcription cloud pour lequel vous fournissez votre propre clé d’API, et iCloud Audio Sync, qui copie l’audio sauvegardé dans votre propre compte iCloud.

  • Seul le texte est conservé. Ce que Hedy garde, c’est la transcription résultante — une représentation textuelle de la conversation, et non l’audio lui-même.

Si vous souhaitez conserver votre audio pour une consultation ultérieure, vous pouvez activer la sauvegarde audio dans les paramètres de session. Lorsque cette option est activée, Hedy stocke l’enregistrement audio localement sur votre appareil aux côtés de la transcription. Même dans ce cas, il n’arrive jamais sur nos serveurs. Sur les appareils Apple, vous pouvez en plus activer iCloud Audio Sync, qui copie le fichier dans votre propre compte iCloud afin que vous puissiez l’écouter sur les autres appareils Apple auxquels vous vous connectez.

La vie privée n’est pas une réflexion après coup, c’est notre principe fondamental. La reconnaissance vocale s’exécute sur l’appareil et l’audio est supprimé par défaut. Par défaut, l’analyse IA cloud traite le contenu de la transcription en mémoire, et le Traitement IA local permet à l’ensemble du processus de s’exécuter sur votre appareil.

Vie privée audio et implications en matière de consentement

De nombreuses lois sur l’enregistrement et la transcription — comme les lois sur le consentement bipartite dans certains États américains, ou le RGPD en Europe — concernent spécifiquement l’enregistrement et le stockage de l’audio. Avec la sauvegarde audio désactivée (paramètre par défaut), Hedy :

  • N’enregistre ni ne sauvegarde de fichiers audio

  • Ne conserve les données audio en mémoire volatile (RAM) que pendant les secondes nécessaires à leur traitement

  • Ne transmet pas d’audio à un serveur ou un tiers

Cela signifie que les exigences de consentement applicables à Hedy peuvent différer de celles applicables aux outils qui enregistrent et stockent l’audio. La transcription textuelle générée par Hedy est stockée sur votre appareil par défaut ; lorsque Cloud Sync est activé, elle est également synchronisée (chiffrée) dans le cloud, et l’analyse IA cloud traite le contenu de la transcription de manière transitoire, sauf si vous utilisez le Traitement IA local.

Si vous activez la sauvegarde audio, l’audio de la conversation sera stocké localement sur votre appareil. Dans ce cas, les mêmes considérations de consentement qui s’appliquent à tout outil d’enregistrement audio peuvent s’appliquer.

Les lois relatives à la vie privée et à l’enregistrement varient selon les juridictions. Nous encourageons les utilisateurs à se familiariser avec les réglementations locales. Ces informations sont fournies à des fins de transparence, et non en tant que conseil juridique.

Transcription en temps réel : Le défi technique

Créer des transcriptions précises et instantanées sur un appareil mobile est extrêmement complexe. Hedy doit équilibrer trois facteurs critiques :

  • Vitesse de traitement

  • Efficacité computationnelle

  • Précision de la reconnaissance vocale

Notre approche privilégie la fourniture d’analyses immédiates. Cela signifie que la transcription que vous voyez est un document vivant et évolutif — capturant l’essence de votre conversation au fur et à mesure.

Comprendre les caractéristiques des transcriptions

Les transcriptions générées par Hedy sont uniques. Elles ne sont pas destinées à être des enregistrements parfaits de niveau judiciaire, mais des captures de conversation dynamiques et alimentées par l’IA. Vous pourriez remarquer :

  • Des variations occasionnelles de ponctuation

  • De légères différences dans le choix des mots

  • Un formatage informel qui capture le flux de la conversation

Considérez la transcription de Hedy comme un preneur de notes qualifié qui capture l’esprit de la conversation, et non comme une machine sténographique.

Noms des intervenants dans votre transcription

Les sessions qui distinguent les voix affichent une rangée de puces d’intervenants au-dessus de la transcription. Chaque puce correspond à un intervenant détecté par Hedy. Appuyez sur une puce pour attribuer un vrai nom à cet intervenant ; dès lors, ce nom est utilisé dans la transcription, la liste des intervenants et tout ce que vous exportez depuis la session.

Hedy essaie également de trouver les noms pour vous. Lorsqu’une personne se présente ou qu’un autre participant l’appelle par son nom, cela constitue un indice et le nom est appliqué automatiquement. L’invitation figurant dans votre calendrier et le contexte du sujet l’aident à identifier la bonne personne. Lorsque les indices sont insuffisants, l’intervenant conserve un numéro au lieu de recevoir un nom au hasard. Il est donc normal que certains intervenants soient nommés et d’autres non.

Un nom que vous saisissez n’est jamais remplacé. Les déductions de Hedy ne servent qu’à nommer les intervenants auxquels vous n’avez pas vous-même attribué de nom.

Les noms restent associés à la session. Ils apparaissent dans les copies, les partages, les téléchargements et les exports, et se synchronisent sur vos autres appareils. Le nettoyage de la transcription utilise les noms que vous avez confirmés, afin que la transcription nettoyée mentionne de vraies personnes.

Renommer un intervenant ne réécrit pas le résumé ni les notes détaillées que vous avez déjà générés. Hedy affiche un rappel vous invitant à utiliser Mettre à jour le résumé ou Mettre à jour les notes lorsque vous souhaitez les actualiser avec les nouveaux noms.

Lorsque les puces n’apparaissent pas

La liste des intervenants nécessite une transcription dont les tours de parole sont séparés, et seul le moteur de reconnaissance vocale Nemotron en produit. Elle s’affiche sur :

  • Mac avec Apple Silicon
  • iPhone 12 et modèles plus récents
  • iPad Air 4 et modèles plus récents
  • Windows
  • Téléphones Android 64 bits

Les sessions capturées avec Whisper ou un fournisseur de reconnaissance vocale dans le cloud ne comportent pas de tours de parole et n’affichent donc aucune puce. Il s’agit d’une propriété de la session, et non d’un réglage que vous pouvez activer par la suite. Une session déjà capturée avec un autre moteur n’obtiendra pas de liste d’intervenants.

L’application web ne peut pas capturer elle-même une session Nemotron, mais elle affiche les puces et vous permet de les renommer pour les sessions synchronisées depuis un autre appareil.

Lorsque le changement de nom n’est pas disponible

Les puces s’affichent, mais ne peuvent pas être modifiées lorsque :

  • La session a été partagée avec vous par quelqu’un d’autre
  • La session est toujours en cours ; terminez-la d’abord
  • Vous consultez la version nettoyée. Revenez à la version Originale à l’aide du bouton à étincelles, renommez l’intervenant, puis retournez à la version nettoyée lorsque vous avez terminé

Nettoyer votre transcription

Si vous souhaitez obtenir une version plus soignée d’une transcription — pour la partager, l’exporter ou simplement la lire plus facilement — Hedy peut produire une copie nettoyée à la demande. Ouvrez n’importe quelle session terminée, accédez à l’onglet Transcription, puis appuyez sur le bouton Nettoyer la transcription (l’icône en forme d’étoiles, ✨, facile à manquer). La transcription originale n’est jamais écrasée ; la version nettoyée est enregistrée à côté, et vous pouvez passer de l’une à l’autre à tout moment.

Trop d’intervenants ? Nettoyer la transcription corrige cela

Hedy identifie automatiquement les intervenants pendant la transcription, en classant les voix qu’elle entend dans des intervenants distincts. Dans les conversations plus longues, ou lorsqu’il y a du bruit de fond ou de l’écho, elle peut en compter trop et diviser une même personne en plusieurs intervenants. Une session à deux personnes peut alors afficher cinq intervenants ou plus. La session n’a rien d’anormal, et vous n’avez pas besoin de la réétiqueter ligne par ligne. La solution consiste à lancer Nettoyer la transcription : Hedy relit toute la session et regroupe les voix, afin que trop d’intervenants, un nombre d’intervenants incorrect, des étiquettes d’intervenants incorrectes ou une voix divisée en plusieurs intervenants soient corrigés en une seule passe.

Avant de le lancer, ouvrez la session et vérifiez les notes. L’outil de nettoyage lit le résumé et les notes détaillées de votre session pour déterminer qui parlait. Lorsque ces éléments nomment clairement les participants réels, la copie nettoyée peut étiqueter les personnes avec leur vrai nom au lieu de revenir à “Intervenant 1” et “Intervenant 2”. Il vaut donc la peine de vérifier que votre résumé ou vos notes nomment tout le monde avant d’appuyer sur Nettoyer la transcription.

Si la copie nettoyée aboutit toujours au mauvais nombre d’intervenants, c’est normal : le nettoyage est généré par l’IA et n’est pas exact à chaque fois. Corrigez les noms dans vos notes ou votre résumé, puis relancez Nettoyer la transcription pour générer une nouvelle copie à partir du contexte mis à jour.

Lorsque vous lancez un nettoyage, l’IA de Hedy :

  • Corrige l’orthographe, la ponctuation et la grammaire sans changer ce qui a été dit

  • Ajoute des étiquettes d’intervenants, en utilisant les noms que vous avez confirmés sur les puces des intervenants, puis les vrais noms des participants lorsque le résumé ou les notes de votre session les identifient, sinon en revenant à “Intervenant 1”, “Intervenant 2”, etc.

  • Améliore la lisibilité globale avec des sauts de paragraphe et une formulation plus claire, et supprime les marqueurs parasites comme [Music] ou >>

  • Applique votre vocabulaire personnalisé afin que les noms d’entreprises, les termes de produit et le jargon technique soient correctement orthographiés

  • Traduit éventuellement la transcription nettoyée dans une autre langue lors de la même étape — choisissez une langue cible dans la boîte de dialogue de nettoyage, ou laissez l’option sur “Conserver la langue d’origine”

Une fois qu’une session dispose d’une version nettoyée, un bouton dans la vue de transcription (l’icône étincelle) permet de basculer entre Originale et Nettoyée. Une bannière indiquant “Transcription nettoyée affichée” apparaît chaque fois que vous êtes dans la vue nettoyée.

Le nettoyage de la transcription utilise un modèle d’IA cloud et s’exécute sur l’appareil qui a capturé la session. Vous ne pouvez pas lancer le nettoyage sur une session synchronisée ou partagée avec vous depuis un autre appareil — seul le propriétaire d’origine, sur l’appareil d’origine, peut nettoyer une transcription.

Pour modifier manuellement le texte de la transcription, revenez à la vue Originale. La modification n’est disponible que sur la transcription brute, afin que votre source de vérité mot pour mot reste intacte. Après modification, vous pouvez relancer le nettoyage pour régénérer une nouvelle copie soignée à partir de vos corrections.

Langue et précision

Nous nous engageons à améliorer la transcription dans toutes les langues. Actuellement, l’anglais offre l’expérience la plus aboutie, mais nous élargissons et affinons continuellement nos capacités de traitement local. À mesure que les processeurs des téléphones deviennent plus puissants, notre transcription deviendra de plus en plus sophistiquée.

Améliorer la qualité de vos transcriptions

Bien que Hedy s’efforce de capturer vos conversations, vous pouvez aider :

  • Parlez clairement et à un rythme modéré

  • Minimisez le bruit de fond

  • Positionnez votre appareil de manière optimale

Si les transcriptions restent brouillées ou incomplètes, consultez comment corriger une mauvaise qualité de transcription. Si une session terminée affiche trop d’intervenants, il s’agit d’un travail de nettoyage plutôt que d’un problème de capture : consultez la section Nettoyer votre transcription ci-dessus.

Le bruit de fond, les interlocuteurs multiples se chevauchant et les environnements audio complexes peuvent mettre au défi même la reconnaissance vocale la plus avancée.

Accéder et utiliser vos transcriptions

Hedy rend vos transcriptions facilement accessibles :

  • Consultez-les en temps réel pendant les sessions

  • Passez en revue les sessions passées

  • Partagez ou exportez pour une analyse approfondie

  • Intégrées aux analyses IA et aux points importants

L’avenir de la transcription locale

Nous ne faisons que commencer. Notre feuille de route comprend :

  • L’extension du support linguistique

  • L’amélioration des algorithmes de traitement

  • Le renforcement de la précision en temps réel

  • La réduction de la charge computationnelle