Desarrollo · Data · IA

Teleprompter local por voz

Teleprompter que avanza al ritmo de la voz usando Whisper local, sin enviar datos a la nube.

1 estrella2026rol: autor únicoestado: activo
portada procedural — capturas reales a la esperaPortada procedural del proyecto Teleprompter local por voz.

01 Resumen

Teleprompter de escritorio que sincroniza el desplazamiento del guion con la voz del locutor en tiempo real, con procesamiento 100% offline. Captura el audio del micrófono, lo transcribe localmente con faster-whisper sobre GPU NVIDIA (CUDA) y alinea la transcripción con el guion mediante un matcher determinista con matching difuso, comunicando la posición al frontend por WebSocket desde un backend FastAPI. Incluye modo auto-scroll clásico, directivas de escena ignoradas por el reconocedor y un modo stealth como app nativa con pywebview.

02 Aspectos destacados

  • Reconocimiento de voz local con faster-whisper acelerado por CUDA, configurable por variables de entorno (modelo, dispositivo, precisión).
  • Algoritmo de alineación determinista guion-transcripción con normalización Unicode y matching difuso tipo Levenshtein ≤ 1.
  • Backend FastAPI con protocolo WebSocket propio que orquesta captura de audio, STT y matcher en tiempo real.
  • Modo stealth como aplicación nativa vía pywebview, con always-on-top y bloqueo de interacción.
  • Frontend en HTML/CSS/JS vanilla con auto-scroll, directivas de escena entre corchetes y atajos de teclado.

03 Capturas