Audio a Texto
100% local: el modelo de transcripción (Whisper, unos 40-90 MB) se descarga una sola vez y queda en caché en tu navegador; después transcribe completamente en tu dispositivo — tu audio nunca se sube a ningún servidor, y puedes usarlo sin límite. Funciona mejor con audio claro y sin mucho ruido de fondo; los archivos largos pueden tardar varios minutos en equipos modestos.
Sobre esta herramienta
Convierte un archivo de audio (MP3, WAV, M4A, OGG) o una grabación hecha directamente con tu micrófono en texto, completamente en tu navegador y sin límite de uso. Usa Whisper, el modelo de reconocimiento de voz de código abierto de OpenAI, ejecutado localmente mediante Transformers.js — se descarga una sola vez (la primera vez que usas la herramienta) y queda en caché en tu navegador, así que tu audio nunca se sube a ningún servidor: útil para transcribir notas de voz, entrevistas o audios que prefieres mantener privados. Puedes dejar que detecte el idioma automáticamente o indicarlo manualmente para mejorar la precisión. Funciona mejor con audio claro y con poco ruido de fondo; los archivos largos o los equipos modestos pueden tardar varios minutos en procesar, ya que todo el cálculo ocurre en tu propio dispositivo.