Enfocar el rostro de quien habla: reframe active speaker
La cámara del corte sigue sola a quien habla en la escena. Entiende cómo funciona el reframe active speaker y por qué mejora la calidad de tu corte.

Enfocar el rostro de quien habla: el detalle que diferencia a un aficionado de un editor
Tomaste un fragmento excelente de un podcast con dos personas, lo pusiste en formato 9:16 y el resultado quedó raro: cámara fija en el centro de la mesa, nadie enfocado, los dos invitados apretados en los bordes. El problema no es el momento, es el encuadre. Enfocar el rostro de quien habla es lo que hace que un corte parezca editado a mano en lugar de recortado automáticamente.
Esta función tiene nombre técnico: reframe active speaker. En lugar de mantener un recorte central estático, la cámara del corte sigue a quien está hablando en ese instante — cambia de un invitado a otro conforme avanza la conversación. Es exactamente lo que haría un editor humano manualmente, cuadro a cuadro. En Picotta esto sucede solo, en cada corte.
Qué es el reframe active speaker
El reframe común ya reencuadra el video horizontal a vertical siguiendo el rostro principal. El active speaker va un paso más allá: cuando hay más de una persona en escena, decide quién está hablando y enfoca a esa persona.
Para esto, Picotta cruza dos señales:
- Movimiento de boca por persona — el detector rastrea cada rostro entre los cuadros y mide la actividad de la boca de cada uno (no solo si la persona está en pantalla, sino si realmente está hablando).
- La máscara de voz de la transcripción — el mismo audio que genera la leyenda indica cuándo hay voz. Cruzando "quién mueve la boca" con "cuándo hay sonido", el sistema identifica al hablante.
El resultado es una cámara que cambia el foco en el momento justo y no salta sin sentido. Un movimiento de cabeza no se interpreta como "habla"; la audiencia moviéndose al fondo no roba el cuadro.
Cómo evita los errores clásicos
Enfocar a quien habla parece simple, pero es fácil fallar. Picotta fue calibrada con videos reales para no caer en trampas:
- Movimiento no es voz. Quien camina o gesticula mucho no se confunde con el hablante — el desplazamiento del rostro descuenta la señal de boca.
- Filtro de protagonista. Solo compite por el foco quien tiene un rostro suficientemente grande en la escena. La audiencia al fondo queda fuera.
- Corte seco al cambiar. Cuando el hablante cambia de lado, el encuadre hace un corte instantáneo, como un editor haría — nada de panorámicas lentas cruzando la mesa.
- Tiempo mínimo en el hablante. Para cambiar de persona, el nuevo hablante debe dominar por un tiempo sostenido. Esto elimina el efecto "ping-pong" en conversaciones rápidas.
Cuándo Picotta usa cada modo de encuadre
No todo video es dos personas conversando. Por eso el encuadre se decide por corte, observando la escena:
| Escena | Qué hace Picotta |
|---|---|
| Dos o más personas conversando | Sigue a quien habla (active speaker) |
| Dos personas bien separadas todo el tiempo | Pantalla apilada (una arriba, otra abajo) |
| Una persona hablando | Sigue su rostro |
| Escenario/púlpito filmado de lejos | Recorte central en la persona |
| Escena abierta, sin rostro estable | Encuadre con fondo desenfocado, sin cortar cabeza |
| Slide + webcam, gameplay + facecam | Layout apilado (contenido + cámara) |
No necesitas configurar nada: en modo recomendado, el estudio elige. Pero si quieres, puedes — hay un toggle "Enfocar rostro" al generar y un selector de encuadre (Automático / Seguir rostro / Central / Pantalla completa / Apilado) en el editor de corte, sin gastar créditos para reprocesar.
Por qué esto importa para tu contenido
Un corte bien encuadrado atrae más. La mirada del espectador va directo al rostro de quien habla, la leyenda aparece abajo y el mensaje llega sin ruido. Corte torcido, con cabeza cortada o foco en silla vacía, el dedo ya pasó al siguiente video.
Esto aplica para casi cualquier nicho de contenido hablado:
- Podcasters con dos o más en el estudio — la cámara sigue a quien responde.
- Streamers que reaccionan con invitados en pantalla.
- Iglesias, donde la predicación a distancia gana recorte central en la persona correcta en vez de un plano perdido.
- Agencias que necesitan entregar cortes con aspecto editado para varios clientes, a escala.
El reframe es solo una pieza del corte inteligente. Va junto con los cortes secos (eliminación de pausas y silencios), la leyenda automática y la curaduría por IA que elige los mejores momentos. Si quieres entender el conjunto, la guía de cómo hacer cortes virales lo explica todo.
Cómo se compara Picotta
Enfocar el rostro no es exclusivo nuestro — hay que reconocerlo. Herramientas como OpusClip, Vizard y Klap tienen reframe de calidad y son maduras en lo que hacen. Si tu foco es el mercado estadounidense y pagas en dólares sin problema, son opciones sólidas. Hicimos un comparativo honesto de generadores de cortes mostrando las fortalezas de cada uno.
Dónde destaca Picotta para quienes producen en Brasil:
- Precio en real, con tarjeta brasileña — sin conversión de dólar, sin sorpresas a fin de mes. Mira los planes.
- Monitor de lives que vigila tu canal y corta cuando termina la transmisión.
- Cortes secos y reframe active speaker en el mismo flujo, sin plugins extra.
- Sin "cara de IA" — leyenda y encuadre pensados para parecer trabajo de editor, no plantilla genérica.
Si vienes de otra herramienta, vale la pena leer la comparación directa Cut.Pro vs Picotta.
Empieza a picotear
Enfocar el rostro de quien habla dejó de ser un trabajo manual de horas. Sube un video, deja que el estudio siga al hablante y descarga los cortes listos en 9:16. Puedes ajustar el encuadre después, si quieres, sin gastar créditos.
Empieza a picotear ahora y ve cómo queda tu primer corte. Si quieres explorar más, el blog de Picotta tiene guías sobre leyendas, cortes de live y selección de momentos — y si haces cortes para otros, mira los términos de afiliados para recomendar y ganar.
Pronto pra picotar o seu próximo vídeo?
Cole o link e receba cortes prontos pra postar. Grátis pra testar.
Comece a picotar →Sem cartão de crédito. Cancele quando quiser.