Voz a texto
Procesamiento 100% local
Arrastra y suelta archivos de audio o video aquí
o
Compatible con formatos comunes de audio/video, transcripción local sin subir archivos
Preguntas Frecuentes
La herramienta usa el modelo multilingüe Whisper de OpenAI, que puede reconocer docenas de idiomas como chino, inglés, japonés, coreano, etc. Seleccionar «detección automática» hará que el modelo determine el idioma por sí mismo; si el idioma del audio es conocido, especificarlo manualmente suele ser más preciso. Los resultados de la transcripción se pueden exportar como texto plano o como subtítulos SRT con marcas de tiempo.

