Desarrollo · Data · IA
Teleprompter local por voz
Teleprompter que avanza al ritmo de la voz usando Whisper local, sin enviar datos a la nube.
portada procedural — capturas reales a la esperaPortada procedural del proyecto Teleprompter local por voz.
01 Resumen
Teleprompter de escritorio que sincroniza el desplazamiento del guion con la voz del locutor en tiempo real, con procesamiento 100% offline. Captura el audio del micrófono, lo transcribe localmente con faster-whisper sobre GPU NVIDIA (CUDA) y alinea la transcripción con el guion mediante un matcher determinista con matching difuso, comunicando la posición al frontend por WebSocket desde un backend FastAPI. Incluye modo auto-scroll clásico, directivas de escena ignoradas por el reconocedor y un modo stealth como app nativa con pywebview.
02 Aspectos destacados
- Reconocimiento de voz local con faster-whisper acelerado por CUDA, configurable por variables de entorno (modelo, dispositivo, precisión).
- Algoritmo de alineación determinista guion-transcripción con normalización Unicode y matching difuso tipo Levenshtein ≤ 1.
- Backend FastAPI con protocolo WebSocket propio que orquesta captura de audio, STT y matcher en tiempo real.
- Modo stealth como aplicación nativa vía pywebview, con always-on-top y bloqueo de interacción.
- Frontend en HTML/CSS/JS vanilla con auto-scroll, directivas de escena entre corchetes y atajos de teclado.
03 Capturas
Captura a la espera
Interfaz — a la espera