Por qué eliminamos su audio después de la transcripción
Autor: Hushscript Publicado: Última revisión:
Eliminamos tu audio en el momento en que la transcripción está lista. Ni después de 30 días, ni cuando cierra su cuenta, ni en un programa de limpieza que se ejecuta durante la noche. El archivo se elimina tan pronto como finaliza el trabajo, automáticamente y sin que usted lo solicite.
Las políticas de retención varían según los servicios de transcripción y la diferencia es importante. La guía de limitación de almacenamiento de ICO brinda un principio útil: los datos personales no deben conservarse más tiempo del que requiere su propósito. Hushscript tomó una decisión deliberadamente limitada en cuanto al audio, y esta publicación explica qué significa aquí “retención cero”, cómo funciona la eliminación y cómo eliminar una transcripción guardada cuando haya terminado.
Los argumentos a favor de la eliminación
Retener el audio del cliente crea varias categorías distintas de riesgo. Al eliminarlos, se eliminan todos ellos en lugar de mitigarlos, y esa diferencia importa más de lo que parece a primera vista.
Los datos que no existen no se pueden violar. Cualquier depósito de almacenamiento que contenga audio grabado es un objetivo, y las infracciones rara vez se descubren el día en que ocurren. Los informes de incidentes de seguridad encuentran constantemente que las intrusiones a menudo pasan desapercibidas durante semanas o meses después del compromiso inicial. Una grabación eliminada a los pocos minutos de ser transcrita simplemente no está presente durante ese período de exposición. No hay ninguna copia que exfiltrar.
La misma lógica se aplica al acceso legal y obligatorio. Una citación, una orden judicial o una solicitud de datos sólo pueden llegar a datos que aún existen. El audio que ya se eliminó en el momento de una solicitud no está disponible, no porque alguien lo esté reteniendo o protegiéndolo activamente, sino porque ya no está. Para un periodista con una fuente confidencial, un abogado que posee material privilegiado o un terapeuta que graba una sesión, “ya no lo tenemos” es una posición mucho más fuerte que “lo tenemos pero prometemos guardarlo”.
La eliminación también cierra la exposición accidental. Los sistemas de almacenamiento se configuran mal. Los depósitos de lectura pública son una clase recurrente de incidente de seguridad precisamente porque el error es fácil de cometer y lento de detectar. Un archivo que no persiste no puede quedar expuesto por un error de permisos seis meses después de haberlo subido.
También hay un beneficio más silencioso. La eliminación automática demuestra una intención más que una política. Una declaración de privacidad que dice “borraremos sus datos cuando lo solicite” le pide que confíe tanto en la redacción como en la ejecución: que la solicitud llegue al sistema correcto, que se procese correctamente y que se haya acordado de enviarla. Un sistema que elimina por defecto no depende de nada de eso. El resultado seguro es el que ocurre cuando nadie hace nada.
La compensación es real y vale la pena exponerla claramente. No podrás recuperar el audio de nosotros más tarde porque no hay nada que recuperar. Si alguna vez necesita la grabación original en lugar de la transcripción, conserve su propia copia. Esa es una restricción de diseño que elegimos a propósito, no un vacío que olvidamos llenar.
Qué significa realmente “retención cero”
“Retención cero” es una frase que se usa libremente, por lo que vale la pena ser preciso sobre lo que cubre aquí y lo que no.
Se refiere al audio en el proceso de procesamiento de voz. Después de transcribir su archivo, dos cosas son ciertas a la vez. El archivo de audio se elimina de nuestro almacenamiento de procesamiento y el motor de voz que produjo la transcripción no guarda ninguna copia para entrenamiento del modelo, evaluación de calidad o depuración. Un servicio que utiliza un procesador externo también debe verificar la política de ese procesador; un reclamo de eliminación a nivel de aplicación no responde por sí solo a la pregunta del subprocesador. La ruta de procesamiento de Hushscript se ejecuta sin retención de audio, por lo que la respuesta es la misma en ambos lados: no se retiene ninguna copia una vez finalizada.
La retención cero a nivel de audio no es lo mismo que no conservar ningún dato, y combinar ambas sería deshonesto. Tu cuenta existe. Su transcripción existe en su panel hasta que la elimina. Existe un registro de facturación por los minutos que utilizó, junto con metadatos básicos del trabajo, como la marca de tiempo, la duración y el idioma detectado. Nada de eso es el audio. Lo que deja de existir una vez que se completa la transcripción es la grabación en sí, el único dato que realmente transporta su voz y el contenido de lo que se dijo.
Entonces, cuando vea “retención cero” en este sitio, léalo como una afirmación específica y limitada sobre el audio y el motor de voz, no como una promesa general de que no se almacena nada. La versión estrecha es la que podemos respaldar sin un asterisco.
Cómo funciona la eliminación en Hushscript
Su audio solo se encuentra en un estado transitorio en nuestra infraestructura. Nunca se escribe en un hogar permanente y nunca permanece en una biblioteca esperando a ser abierto nuevamente. El ciclo de vida es corto y unidireccional.
- Tú subes. Colocas un archivo en una página como audio a texto o en uno de los otros puntos de carga. El audio, y sólo el audio, pasa a una cola de procesamiento. Si el archivo es un video, su audio ya ha sido preparado en su navegador (copiado sin volver a codificar cuando sea compatible, convertido localmente solo cuando sea necesario), por lo que los datos del video permanecen en su dispositivo.
- Se transcribe. El motor de voz procesa el audio y devuelve una transcripción con etiquetas de hablante y marcas de tiempo. Esta es la única etapa en la que el audio se utiliza activamente.
- Se devuelve y luego se elimina. La transcripción se escribe en su panel y el archivo de audio se elimina. No existe una cuarta etapa en la que la grabación permanezca almacenada. Pasa del procesamiento directamente a la eliminación.
Como no hay una etapa de reposo, no hay una ventana de retención que configurar u olvidar. El audio está presente mientras se transcribe y ausente inmediatamente después. El resumen técnico cabe en una línea: su audio existe en nuestra infraestructura solo durante la ventana de transcripción, en su dispositivo antes y en ningún lugar después.
Para trabajos delicados, el detalle más útil suele ser dónde se procesan los datos. Si se encuentra en la UE, el EEE, Suiza o el Reino Unido, su audio se procesa en la UE. En todos los demás lugares se procesa en EE. UU. En cualquier caso, el comportamiento de eliminación es idéntico y en cualquier caso la grabación no sobrevive a la transcripción. Puede seguir la ruta completa en la página de cómo funciona, y la página de transcripción privada cubre los detalles específicos del manejo de datos y cómo se comparan con la norma de almacenamiento por defecto.
Un ejemplo práctico: dónde realmente afecta la eliminación
Imagen de una Reunión de cliente grabada de 40 minutos guardada como M4A desde un teléfono. Contiene nombres, cifras y algunas cosas que nadie quiere que estén en el servidor de un extraño.
Dejas caer el archivo en la vista previa sin una cuenta. Aparece un clip de 30 segundos con la etiqueta del hablante para que pueda confirmar que las dos voces se están separando correctamente. Esa vista previa es el único paso que no necesita cuenta. Para transcribir el resto, te registras y las cuentas nuevas obtienen 30 minutos gratis para probar. Una reunión de 40 minutos supera la asignación gratuita, por lo que usted recarga primero; la página de precios tiene el costo por minuto. Luego se transcribe el audio completo y, en el momento en que su transcripción llega al tablero, el M4A se elimina de nuestra parte. Usted vuelve a etiquetar “Hablante 1” y “Hablante 2” con nombres reales, exporta un DOCX para sus registros y la transcripción permanece en su cuenta, cifrada en reposo, hasta que la elimina o una regla de retención la elimina.
El objetivo de recorrerla es mostrar dónde se aplica realmente la garantía. Una vez finalizado el trabajo, Hushscript no guarda una copia almacenada del audio de la reunión. La transcripción es el artefacto que persiste, e incluso eso es suyo para eliminarlo. Un servicio creado como un archivo de grabaciones con capacidad de búsqueda presenta una compensación diferente; lea sus controles de retención antes de elegir ese modelo para trabajos delicados.
Cuando no desee guardar una transcripción
Utilice el modo privado. Solo ejecuta reconocimiento de voz, omite el almacenamiento de transcripciones guardadas y el posprocesamiento de IA, y devuelve un archivo protegido con contraseña en lugar de mantener la transcripción en su cuenta.
Eliminar una transcripción normal
Eliminar el audio gestiona la grabación. La transcripción es la otra mitad y tú la controlas directamente. Después de la transcripción, el texto permanecerá en su panel hasta que lo elimine.
- Abra la transcripción.
- Elija eliminar.
- El texto de la transcripción se elimina.
Ese es el flujo completo. No mantenemos ningún archivo de transcripciones eliminadas, por lo que una vez que las elimina, el texto desaparece de nuestro lado en lugar de trasladarse a una papelera de reciclaje que no puede ver. Si ya sabe que no desea guardar una transcripción, el modo privado es el camino más limpio.
Si prefiere borrar todo de una vez, puede eliminar toda su cuenta de su perfil después de un paso de confirmación. Vale la pena saberlo antes de hacerlo: los minutos que ya haya comprado no se reembolsan al eliminar la cuenta, así que gástelos o téngalos en cuenta primero.
La parte honesta: lo que conservamos y el límite de cifrado
Un reclamo de privacidad solo vale tanto como las partes que admite. Dos cosas merecen una declaración clara y sin publicidad.
Primero, los datos residuales. Eliminamos el audio, pero la transcripción permanece hasta que la eliminas, al igual que el pequeño conjunto de metadatos del trabajo necesarios para ejecutar y facturar el servicio. Esos metadatos tienen un riesgo mucho menor que el audio, ya que describen el trabajo en lugar de transmitir su voz, pero no son nada, y preferimos nombrarlo antes que implicar un borrón y cuenta nueva que no existe.
En segundo lugar, la transcripción que queda está cifrada en reposo. Si alguna vez se filtrara nuestro almacenamiento, lo que un atacante se llevaría sería un texto cifrado ilegible, no un archivo con capacidad de búsqueda de las palabras de todos. Esa es una protección genuina contra una violación del almacenamiento, que es la amenaza para la que está diseñado el cifrado en reposo. Es también donde nos detenemos, deliberadamente. Este no es un cifrado de conocimiento cero. La clave se guarda en nuestros servidores, porque la aplicación debe poder descifrar y mostrarle su propia transcripción cuando la abra. Por lo tanto, no afirmamos que no podamos leer sus transcripciones. Afirmamos que una base de datos robada sería inútil para quien la haya robado sin la clave. Cualquiera que le diga que una herramienta de transcripción puede mostrar sus transcripciones a pedido y ser matemáticamente incapaz de leerlas está pasando por alto cómo funcionan las claves.
Esa es la forma más honesta de lo que dice. El audio se elimina y el motor de voz no guarda nada, lo que elimina la grabación por completo. La transcripción persiste bajo un cifrado que protege contra una filtración, pero no es un bloqueo contra nosotros y puede eliminarla cuando lo desee. Preferiríamos que comprendiera exactamente dónde se encuentra la línea que confiar en un eslogan que la mueve silenciosamente.
La razón más amplia
Lo predeterminado en esta industria es el almacenamiento. Cargue, transcriba y guarde todo en una biblioteca a la que el usuario pueda volver. Para algunas personas, esta es una característica real: un podcaster que crea un archivo con capacidad de búsqueda de sus propios episodios se beneficia de tener cada transcripción en un solo lugar y el contenido no es confidencial.
Pero el almacenamiento es un mal valor predeterminado para grabaciones confidenciales. Un archivo de años de consultas privilegiadas, entrevistas con fuentes o negociaciones internas, almacenado en un servidor de terceros, es una responsabilidad que se agrava silenciosamente con el tiempo. Cuanto más tiempo exista, mayor será la superficie para que aterrice una infracción, una citación o una mala configuración.
La eliminación es la opción predeterminada correcta cuando la transcripción es lo que necesita y el audio es solo el medio para obtenerlo. Si ya posee el archivo fuente, en su propio dispositivo o en su propio almacenamiento, no hay motivo para que conservemos una segunda copia. Así que no lo hacemos.
Para obtener una visión más amplia del riesgo, incluidas las preguntas que vale la pena hacer a cualquier herramienta de transcripción antes de cargarla, consulte por qué no se debe cargar su audio. El comportamiento de eliminación descrito allí es el mismo que se trata aquí; esa publicación se acerca al conjunto completo de compensaciones de privacidad para grabaciones confidenciales.
Fuentes y normas independientes
Hushscript consultó estas referencias independientes y no competidoras. Explican investigaciones, normas o el funcionamiento de plataformas y no implican el respaldo de Hushscript.
Fuentes revisadas: