Novedades en Hedy: nombres de hablantes, detección de reuniones y exportaciones de documentos
Hedy ahora pone nombres reales a las voces de su transcripción y los incorpora al recap y las notas, detecta reuniones que empiezan en Mac y Windows y guarda sesiones como Word o PDF.
Una transcripción que dice “Hablante 2 se comprometió a cumplir el plazo” solo es útil a medias. Todavía tiene que averiguar quién era el Hablante 2, y si el resumen y las notas no coinciden sobre su identidad, acaba por no confiar en ninguno de los dos.
Ese es el problema que las últimas versiones de Hedy se propusieron resolver.
Hedy averigua quién habla
Hedy ya separaba las voces de una conversación. La novedad es que ahora averigua los nombres que hay detrás.
Lee la conversación en busca de pruebas reales: que alguien se presente o que otro participante se dirija a esa persona por su nombre. La invitación de su calendario y cualquier contexto del tema que haya configurado le ayudan a asociar a la persona correcta con la voz correcta. Cuando no encuentra esas pruebas, Hedy deja al hablante con su número en vez de adivinar, así que una sesión en la que dos personas tienen nombre y una no es normal y esperable.
Lo más importante es lo que ocurre después. Lo que Hedy averigua se aplica una sola vez y se usa en todo lo que escribe: la transcripción, el recap, las notas detalladas y sus elementos pendientes parten del mismo conjunto de nombres, en vez de decidir cada uno por su cuenta quién era quién.
Usted mantiene el control. Las sesiones con turnos de hablante muestran una fila de chips de hablante encima de la transcripción, y al tocar uno puede escribir el nombre correcto. Hedy nunca sobrescribe un nombre que usted haya asignado, y ese nombre acompaña a la sesión en las copias, los elementos compartidos, las descargas y sus otros dispositivos. Si cambia el nombre de alguien después de que el recap y las notas ya se hayan generado, estos conservarán el nombre anterior hasta que los actualice, y Hedy le pedirá que haga justo eso. Puede cambiar nombres en sus propias transcripciones finalizadas; las sesiones compartidas con usted, las que siguen en curso y la vista limpia son de solo lectura.
Los nombres de los hablantes proceden del motor Nemotron de Hedy que funciona en el dispositivo, que es el que separa las voces en primer lugar. Si usa Whisper o un proveedor de reconocimiento de voz en la nube, cambie de motor en Configuración → Voz e IA y su siguiente sesión incluirá nombres. Funciona en Mac con Apple Silicon, iPhone 12 y modelos posteriores, iPad Air 4 y modelos posteriores, Windows y teléfonos Android de 64 bits.
Hedy detecta que empieza la reunión
En Mac y Windows, Hedy detecta el inicio de una llamada en Zoom, Microsoft Teams o Webex, además de FaceTime en Mac, y le ofrece iniciar una sesión.
Es un detalle pequeño que evita la forma más habitual de perder una sesión: entrar en la llamada, meterse de lleno en ella y acordarse de Hedy veinte minutos después. Recibe el aviso, acepta y Hedy empieza a capturar.
Hedy mantiene límites claros en todo momento. Solo comprueba si una de esas aplicaciones empieza a usar el micrófono; no escucha nada y no captura nada hasta que usted acepta.
En iPhone y Android existe una versión basada en el calendario de la misma idea: conecte Google Calendar, active Detectar automáticamente reuniones programadas y Hedy le ofrecerá iniciar una sesión cuando empiece una reunión programada.
Lleve una sesión a cualquier parte
Ahora puede guardar una sesión de Hedy como un documento de verdad. Abra una y elija Descargar resumen, Descargar notas detalladas o Descargar todos los datos; después, seleccione el formato: texto sin formato, Markdown, Word o PDF.
Word y PDF conservan los títulos, las listas, las citas y las tablas en vez de convertirlo todo en un único bloque largo de texto, por lo que un recap que envíe a un cliente parece un documento y no un volcado de texto. PDF cubre los caracteres incluidos en la fuente que incorpora Hedy, y para cualquier carácter que quede fuera Hedy le indica que use Word.
Conviene saber dos cosas sobre el contenido de cada archivo. Descargar todos los datos reúne el recap, las notas detalladas, sus notas de sesión, los momentos destacados, el historial de chat y los elementos pendientes, pero no la transcripción. La transcripción tiene su propia acción Descargar transcripción y se guarda como archivo de texto.
Si alguna vez ha dudado en guardar sus reuniones en una herramienta porque no sabía si podría recuperarlas, esta es la respuesta.
Todos los elementos de acción de un proyecto, juntos
Las sesiones que pertenecen a un tema ahora comparten una pestaña Tareas. Abra el tema y verá todos los elementos de acción de todas sus sesiones, ordenados por fecha de vencimiento o por la sesión de la que proceden.
Puede editarlos y completarlos allí mismo, y ocultar los completados cuando un proyecto se alarga. Completar un elemento allí también lo completa en su sesión original, porque solo hay una copia que se muestra de dos formas. Un tema que alguien haya compartido con usted es de solo lectura.
Antes tenía que abrir las sesiones una a una para reconstruir lo que debía a cada persona. Para cualquier proyecto que dure más de un par de reuniones, esa era la parte tediosa.
También conviene saberlo
Estas son algunas novedades más pequeñas que llegaron al mismo tiempo:
- Decida qué hacer con el audio antes de empezar. En Mac, Windows, iPhone, iPad y Android, ahora hay un interruptor Guardar audio de la sesión en el panel de inicio, para que pueda elegir en cada sesión si desea conservar el audio en vez de buscar la opción en Configuración. Como siempre, obtenga el consentimiento de las personas presentes antes de guardar el audio.
- Las fusiones de sesiones conservan todo. Combinar dos sesiones ahora también conserva el historial de chat y las notas de sesión, no solo la transcripción.
- Más idiomas y modelos más recientes. Deepgram añade alemán de Suiza, armenio, guyaratí, nepalí y panyabí, además de más variantes regionales. Las nuevas sesiones de OpenAI usan sus modelos de voz actuales, y cualquier modelo que ya tuviera seleccionado sigue funcionando. Ambos proveedores usan su propia clave de API.
- Sugerencias ajustables en Mac. Los avisos emergentes de sugerencias ahora tienen su propio menú para ocultar alertas, cambiar la frecuencia con la que aparecen y elegir si siguen al cursor.
- Importaciones en segundo plano en iPhone y iPad. En iOS y iPadOS 26, la importación de audio o video sigue ejecutándose cuando cambia de aplicación o bloquea la pantalla.
Obtener la actualización
Hedy se actualiza automáticamente en Mac y Windows. En iPhone, iPad y Android, descárguela desde App Store o Google Play. Todo lo anterior está incluido en la versión actual.
Si ha estado usando Whisper, lo único que vale la pena hacer hoy es cambiar a Nemotron en Configuración → Voz e IA. Es lo que habilita los nombres de los hablantes, y estamos trabajando para convertirlo en la opción predeterminada, para que nadie tenga que pensar en ello.
About the author
Julian Pscheid is the founder and CEO of Hedy AI, a real-time AI meeting coach used by tens of thousands of professionals worldwide. He writes about how AI is changing the way people prepare for, capture, and understand important conversations.