qktools

Voz a texto

Procesamiento 100% local

Arrastra y suelta archivos de audio o video aquí

o

Compatible con formatos comunes de audio/video, transcripción local sin subir archivos

Preguntas Frecuentes

La herramienta usa el modelo multilingüe Whisper de OpenAI, que puede reconocer docenas de idiomas como chino, inglés, japonés, coreano, etc. Seleccionar «detección automática» hará que el modelo determine el idioma por sí mismo; si el idioma del audio es conocido, especificarlo manualmente suele ser más preciso. Los resultados de la transcripción se pueden exportar como texto plano o como subtítulos SRT con marcas de tiempo.