Privado por diseño
Los rostros se analizan en tu navegador, en tu computadora. Tus fotogramas nunca se envían a un servidor para analizarlos.
El AI Director observa cada cámara, lee quién mira al lente, el gesto de hablar y hacia dónde giran las cabezas, y corta a la mejor toma al ritmo de tu show. Sin manos, directo en tu navegador.
Cómo decide
Varias veces por segundo, cada cámara recibe una puntuación según lo que muestra su rostro. Cuando otra cámara lidera con claridad y la toma actual ya duró lo suficiente para tu show, corta.
El iris y los puntos del rostro indican quién mira al lente, la señal más fuerte de a quién pertenece el show en ese momento.
El gesto de hablar se lee en el rostro, así un micrófono compartido en el set nunca confunde qué cámara está hablando. Con tu micrófono en la mezcla, un modelo de voz confirma cuándo alguien habla de verdad.
Hacia dónde giran las cabezas, en 3D. Un invitado que se gira para responder al presentador es una señal para cortar.
Una sesión real · Dos cámaras
Una sesión real, no una simulación: el presentador alterna entre su webcam y su celular, y el AI Director corta solo. La malla y las puntuaciones son lo que MediaPipe Face Landmarker, el modelo que usa el AI Director, mide fotograma a fotograma sobre la imagen completa de cada cámara.
Lee cada slot de cámara
Cada cámara conectada se analiza a su resolución completa, varias veces por segundo.
Ve quién mira al lente
La malla facial, el iris y los ejes de la cabeza le dan a cada cámara su puntuación.
Detecta el giro
Cuando el presentador aparta la mirada, bajan las puntuaciones de mirada y cabeza de esa cámara.
Corta a la cámara correcta
La cámara que el presentador mira ahora gana y pasa a Program.
Midiendo CAM 1
Ritmo
Un podcast tranquilo y un stream de gaming rápido no deberían cortar igual. Elige un tipo de show y el AI Director ajusta cuánto sostiene una toma, qué tan seguro debe estar y cuánto pesa cada señal.
4 s
Tiempo mínimo entre cortes
Cambios tranquilos y estables para conversaciones sentadas.
Lo máximo que podría cortar en 20 segundos
A tu medidaCada tipo de show es un punto de partida. Afina la duración mínima de cada toma y cuánto pesa cada señal desde el panel del AI Director.
Se encarga de los cortes para que tú te encargues del show, y nunca se interpone.
Los rostros se analizan en tu navegador, en tu computadora. Tus fotogramas nunca se envían a un servidor para analizarlos.
Corta al primer plano de quien toma la palabra y abre al plano general cuando hablan dos a la vez. Si tu micrófono está en la mezcla, también escucha para decidir.
Las entradas con capas de cámara se vuelven presets que la IA omite, así un plano general compuesto solo sale cuando tú lo eliges.
Actívalo o desactívalo con un clic o un botón MIDI. Mientras funciona, los atajos de teclado se pausan para que nada compita por el switcher.
Analiza webcams locales y cámaras WebRTC: tu celular conectado por código QR e invitados remotos.
El análisis corre en workers paralelos en segundo plano, de 1 a 8 según tu plan, para que más cámaras sigan respondiendo.
Solo para saber cuándo alguien habla, si tu micrófono está en la mezcla. Un modelo de voz corre en tu navegador y tu audio nunca sale de tu computadora. Quién habla se lee en los rostros, porque un micrófono puede servir a muchas cámaras.
No. El análisis corre en tu navegador, en tu computadora. Solo se descarga el modelo de detección.
Al menos dos entradas activas. Las entradas con capas de cámara se mantienen como presets manuales y no cuentan.
Los planes con dos o más entradas, desde Beginning. Los planes superiores ejecutan más workers de análisis en paralelo.
Sí. Desactívalo con un clic o un botón MIDI y cambia a mano. Vuelve a activarlo cuando quieras.
Un navegador moderno. En equipos más modestos, baja la resolución o los fotogramas por segundo del análisis en el panel Avanzado.
Conecta dos cámaras, activa el AI Director y concéntrate en tu show.
Empieza gratis