Audiodescripción en vivo

Control del narrador SAP. Usá Stop/Start para el pipeline; Reiniciar servicios si se trabó todo.

Estado

Detenido Programa App — Ingest —
Última latencia (e2e)
Visión / TTS
Voz TTS
Idioma
Cola de audio
Frames vistos
Frases dichas
Logo (color)
Última narración Todavía no hay narración.

Latencias: Última (e2e) = ciclo completo hasta encolar el audio. Visión / TTS = solo Gemini + síntesis de voz (suma aproximada; el e2e suele ser un poco mayor).

Datos técnicos (JSON)

Pipeline

Iniciar/Detener solo para el narrador. “Ver zona del logo” abre el recorte usado para detectar tanda (B/N).

Idioma / Language

Al cambiar, se cargan prompts base del idioma y solo se listan voces de ese idioma. Después podés editar los prompts abajo.

Voz (Azure Speech)

Aplica a la próxima narración sin reiniciar.

Servicios del servidor

App = narración + panel. Ingest = MediaMTX (OBS/RTMP). “Todo” reinicia ambos; la página puede cortarse unos segundos.

Conexiones

Prompts Gemini (edición en vivo)

Los cambios aplican a la próxima frase, sin reiniciar. Ideal para afinar en esta etapa.