¿Para qué sirve MurText?
MurText convierte los archivos de audio y video de su computadora en contenido escrito.
¿Cuáles son las características que diferencian a MurText de otros programas?
• Es 100% gratuito. No utiliza la expresión "gratuito" como técnica de marketing.
• Ofrece transcripción ilimitada.
• No necesitas cargar el archivo que deseas transcribir en ningún lugar.
• No requiere conexión a Internet para realizar la transcripción.
• Trabaja enfocado en el "resultado". La prioridad siempre es el resultado.
• Su diseño sencillo y amigable es accesible para todos.
• Transcribe en más de 100 idiomas.
• Tú decides qué modelo utilizar.
• El método de uso del menú contextual es práctico y funcional.
• Ofrece soporte multilingüe.
¿Cómo obtener una clave de acceso de Hugging Face?
Para usar la función de reconocimiento de hablantes y alineación, debe disponer de una clave de acceso. Las claves de acceso proporcionadas gratuitamente por Hugging Face deben estar autorizadas en 2 modelos. Puede crear una clave de acceso de Hugging Face siguiendo los pasos que se indican a continuación.
1. Abra https://huggingface.co/login. Si ya está registrado, inicie sesión directamente o cree una cuenta.
2. Abra el menú "Perfil". Haga clic en el enlace "Settings". Haga clic en el encabezado "Access Tokens" en la página.
Nota: Después de hacer clic en el enlace, las opciones se abren más abajo en la misma página. Si usa un lector de pantalla, puede navegar con el atajo de encabezado de nivel 3.
3. Haga clic en el enlace "Create new token".
3.1. Rellene el campo "Token name".
3.2. Marque las casillas de verificación en la página y haga clic en el botón "Create token".
3.3. Copie la clave de acceso que se le proporciona. Debe conceder acceso a 2 modelos para que la clave funcione.
4. Vaya a https://huggingface.co/pyannote/speaker-diarization-community-1.
4.1. Busque el botón "Agree and access repository" en la página.
4.2. Justo debajo del botón hay dos campos de formulario con fines estadísticos. Rellene los campos "Company/university" y "Use case".
4.3. Después de rellenar los formularios, haga clic en el botón "Agree and access repository" en la parte inferior.
5. Vaya a https://huggingface.co/pyannote/segmentation-3.0.
5.1. Busque el botón "Agree and access repository" en la página.
5.2. Justo debajo del botón hay dos campos de formulario con fines estadísticos. Rellene los formularios y haga clic en el botón "Agree and access repository" en la parte inferior.
¿Puede MurText crear archivos de subtítulos?
Sí. MurText puede crear archivos de subtítulos con las extensiones .srt y .vtt. Solo necesita enviar el archivo a la aplicación y realizar las selecciones necesarias.
¿Hay una función de reconocimiento de hablantes?
Sí. Puede activar esta función utilizando su clave de acceso gratuita proporcionada por Hugging Face. Durante el proceso de transcripción, los hablantes serán identificados con diferentes nombres. Posteriormente, puede renombrar los hablantes si lo desea.
¿Con qué propósito se desarrolló la aplicación?
MurText fue desarrollado para que las personas ciegas y sordas puedan convertir en texto sus archivos de audio y video. Para que sea práctico y rápido, el procesamiento se realiza en el dispositivo local. Esta situación ofrece una solución segura para relaciones en las que la privacidad es prioritaria, como médico-paciente o periodista-fuente.
¿Cuáles son las ventajas de realizar la transcripción en el dispositivo local?
• Tu privacidad está 100% garantizada.
• Tus archivos no se utilizan en el proceso de entrenamiento del modelo.
• No hay dependencia de Internet.
• No pierdes tiempo transfiriendo el archivo a un servidor en la nube.
• No compartes tus textos transcritos.
• No tienes que preocuparte por limpiar procesos de recopilación de información como textos que consideras privados o historiales de uso.
• Llegas rápidamente al resultado.
• Puedes guardar tus archivos transcritos de la forma y en la carpeta que desees.
• ¡Obtienes el valor del dinero que pagaste por el procesador de tu computadora! ☺
¿Cómo puedo corregir los errores ortográficos en el archivo de subtítulos?
Los errores ortográficos surgen de una transcripción incorrecta de los sonidos. Puede usar el modelo large-v3 para minimizar los errores ortográficos durante la transcripción. Después de la transcripción, puede corregir estos errores con la ayuda de inteligencia artificial. Claude muestra el mejor rendimiento para este tipo de edición. Cuando proporcione el archivo .srt a una IA, no olvide dar las siguientes instrucciones estrictas:
• Nunca toque las marcas de tiempo.
• Trate las marcas de tiempo como valores numéricos (enteros). Nunca las trate como cadenas de texto.
• No use caracteres que causen problemas en CMD, como ':', '\', '%' si aparecen en el texto. No intente manejarlos con caracteres de escape.
• Corrija los nombres de origen extranjero y los términos técnicos que aparecen en el texto.
• Al final del proceso, compruebe si hay superposiciones de tiempo entre los segmentos.
Recibo una advertencia de "Protección de aplicaciones inteligente" y de Windows Defender, ¿qué debo hacer?
MurText no es un software con fines comerciales. Utilizamos nuestros limitados recursos financieros en servicios de servidor y otros proyectos. Por esta razón, el software no está firmado con un certificado SSL. Körüz.biz es una organización no gubernamental activa desde 2014. Puede analizar el software con cualquier aplicación antivirus que prefiera. No contiene ningún contenido dañino. Windows muestra estas advertencias para todo el software que no está firmado digitalmente, ya que este es su enfoque estándar.
¿Qué archivo de subtítulos debo usar?
MurText genera archivos de subtítulos en dos ubicaciones diferentes durante el proceso de transcripción.
Los archivos ubicados dentro del directorio del proyecto se configuran según los ajustes del software.
Los archivos bajo Directorio del proyecto\fallback son archivos sin procesar generados directamente durante la transcripción.
Si planea editar el archivo .srt generado más adelante en un editor SRT, puede usar los archivos .srt y .vtt que se encuentran bajo fallback\. Esto se debe a que estos archivos no pasan por procesamientos como la definición del número de caracteres por línea o la división de líneas.
Si desea verificar la ortografía del archivo .srt y usarlo directamente, puede preferir los archivos del directorio del proyecto.
¿Cómo se instala?
• Descarga el archivo de instalación desde el menú del sitio y sigue las instrucciones para instalar la aplicación.
• Define el idioma de la aplicación y el idioma de los archivos que transcribirás con mayor frecuencia.
• Descarga el paquete del modelo que desees.
• Abre la aplicación MurText cuando la necesites o haz clic derecho en el archivo y selecciona la opción "MurText Speech-To-Text".
• El proceso de transcripción comenzará según las preferencias que hayas realizado.
¿Qué motor de transcripción debo usar?
Si su objetivo es generar archivos de subtítulos, le recomendamos usar el motor WhisperX. En este motor, se calculan los tiempos de inicio y fin a nivel de palabra, lo que produce marcas de tiempo mucho más realistas. En el motor Fast-Whisper, los segmentos de subtítulos se generan utilizando las marcas de tiempo devueltas por el modelo. WhisperX muestra mejor rendimiento en intervalos de tiempo con silencios prolongados, ruido de fondo o música.
¿Cuál es la tasa de precisión de los subtítulos generados?
Esto varía según el motor de transcripción elegido y la calidad del archivo. Con el motor WhisperX y un archivo de calidad de audio normal, la tasa de éxito se sitúa entre el 91 y el 96% (excluyendo errores ortográficos menores y desviaciones de tiempo imperceptibles).
Uso una tarjeta gráfica NVIDIA pero el procesamiento se realiza con la CPU, ¿por qué?
Hay dos posibles razones para esto: 1. Las especificaciones técnicas de su tarjeta gráfica son insuficientes, o está usando un modelo de tarjeta gráfica antiguo.
2. Su tarjeta gráfica es nueva pero los modelos de IA utilizados por MurText aún no han sido configurados para estas tarjetas. (Ejemplo: El modelo NVIDIA 5060 puede usarse activamente en el modelo de transcripción. Sin embargo, el modelo de alineación de palabras aún no admite la arquitectura sm_150. Si se encuentra un proceso no compatible, la transcripción continúa con la CPU.)
¿Hay alguna limitación de tiempo?
No, con MurText puedes transcribir tantos archivos como desees.
¿Solo se transcriben archivos cortos y de poco tamaño?
No, no hay restricción en cuanto a la duración del archivo. Sin embargo, te recomendamos prestar atención a ciertos aspectos. (Consulta: ¿A qué debo prestar atención al transcribir?)
¿A qué debo prestar atención al transcribir?
• Debes seleccionar correctamente el idioma de tu archivo. Si eliges el idioma incorrecto, el tiempo de transcripción se alargará o el archivo se transcribirá incorrectamente.
• Si no conoces el idioma del archivo, debes usar la opción "Detección automática de idioma X".
• Dividir en varias partes tus archivos de más de una hora acorta el tiempo de transcripción.
• La elección del paquete de modelo influye directamente en la calidad y duración de la transcripción. Si algunos pequeños errores no son importantes para ti, elige el modelo más adecuado.
¿Qué es el modelo Whisper?
Whisper es un modelo de reconocimiento de voz desarrollado por OpenAI. Este modelo, apoyado en inteligencia artificial, reconoce muchos idiomas de uso común en el mundo y transcribe archivos de audio en esos idiomas.
¿Cómo funciona el modelo Whisper?
El modelo Whisper está compuesto por paquetes de reconocimiento de voz con extensión .pt. El archivo de audio se envía al modelo seleccionado por la aplicación. El modelo divide el archivo recibido en fragmentos y luego comienza a transcribir esos fragmentos. Como se trabaja en varios fragmentos al mismo tiempo, el tiempo de transcripción es menor que la duración del archivo. Una vez traducidos los fragmentos, los resultados obtenidos se combinan.
¿Se comparten mis archivos en algún lugar?
No, tu archivo se transcribe sin salir de tu dispositivo. El proceso de transcripción se realiza completamente utilizando el procesador y otros componentes de tu dispositivo.
¿El uso de MurText requiere conexión a Internet?
No. MurText solo requiere conexión a Internet al descargar modelos y al verificar nuevas versiones.
¿Se comparte algún archivo de mi dispositivo?
No. Ningún dato, incluidos los registros de error de la aplicación, sale de tu dispositivo.
¿Cuánto tiempo tarda la transcripción?
El tiempo de transcripción varía según el tamaño y la calidad del archivo y las especificaciones de hardware de su dispositivo. Si dispone de una tarjeta gráfica NVIDIA con soporte CUDA, la transcripción se realiza más rápidamente con soporte GPU. Si no dispone de una tarjeta gráfica NVIDIA o tiene un modelo de GPU no compatible, el procesamiento se realiza con la CPU.
¿Puedo usar mi computadora mientras se realiza la transcripción?
Sí, puedes seguir usando tu computadora durante el proceso de transcripción. Normalmente, tu sistema operativo gestiona automáticamente la distribución de recursos. Sin embargo, realizar tareas que consumen muchos recursos de procesador y memoria, como jugar a un videojuego exigente, mientras transcribes un archivo largo con un modelo de alta capacidad, puede alargar el tiempo de transcripción.
¿En qué sistemas operativos funciona MurText?
Puedes usar MurText en sistemas operativos Microsoft Windows 7 y posteriores. En las pruebas de accesibilidad y rendimiento de la aplicación se utilizó Windows 11.
¿Hay soporte para Mac?
Se está planificando una versión para Mac en próximas versiones.
¿Qué tipos de archivos son compatibles?
.aac .avi .dat .flac .flv .m4a .m4v .mkv .mov .mp3 .mp4 .mpeg .mpg .ogg .opus .ts .wav .waptt
Recibo un mensaje de error, ¿qué debo hacer?
Asegúrese de estar usando la última versión de la aplicación. Reinstale la última versión y desmarque la opción "Conservar la configuración de la aplicación" indicada durante la instalación. Si el problema persiste, elimine el modelo Whisper que está usando y descárguelo de nuevo. Si el resultado no cambia a pesar de todo esto, contáctenos usando el botón "Reportar error".
¿Cómo puedo volver a descargar el paquete de modelos?
Vaya a la página "Modelos" en la configuración de la aplicación. Haga clic en el botón "Eliminar" junto al modelo con el que desea trabajar. Una vez que el botón cambie a la posición "Descargar", descargue el modelo de nuevo.
Recibo un error de actualización, ¿qué debo hacer?
• Asegúrate de tener una conexión a Internet activa antes de comenzar la actualización.
• Si has modificado el archivo de configuración de la aplicación, puedes recibir errores. Borra el contenido del archivo de configuración y reinicia la aplicación.
• Si apagaste tu dispositivo mientras se abrían los archivos de actualización, es posible que el proceso se haya interrumpido. La solución más práctica es desinstalar y volver a instalar la aplicación.
¿Cómo se cambia el idioma de la interfaz de la aplicación?
Ve a Configuración > Selección de idioma de la aplicación, elige el idioma y guarda la configuración. Si deseas utilizar la interfaz en tu idioma nativo, puedes traducir el archivo "default.po" en la carpeta de la aplicación y enviárnoslo.