La mayor parte del testeo creativo en paid social no es testeo. Es lanzar varios avisos, esperar y promover al que la plataforma más gastó. Eso produce un ganador y cero conocimiento — y el mes que viene empezás de cero otra vez, porque nunca aprendiste por qué ganó.

Un test que produce conocimiento tiene estructura. Acá va una que funciona y no requiere presupuesto de investigación.

Qué estás testeando en realidad

La creatividad tiene capas, y no pesan lo mismo:

  1. El mensaje. Qué promesa se está haciendo. “Más barato que la alternativa” contra “más rápido de implementar” contra “el que usan los profesionales”.
  2. El formato. Video, estático, carrusel, grabado por creador.
  3. El hook. Los primeros dos segundos o el tercio superior de la imagen: lo que frena el scroll.
  4. La ejecución. Colores, largo del copy, layout, la edición concreta.

Están en orden de impacto. Los cambios de mensaje producen saltos; los cambios de ejecución producen ruido. La mayoría de los equipos gasta su capacidad de testeo en la capa cuatro, y por eso la mayoría de los programas de testeo creativo se siente como si no avanzara.

Testeá mensajes primero. Recién cuando un mensaje gane con claridad vale la pena optimizar su ejecución.

Una variable, o no es un test

Si el aviso nuevo tiene otro título, otra imagen y otro llamado a la acción, y gana, aprendiste que este aviso le gana a aquel aviso. No aprendiste nada que puedas aplicar al siguiente.

La disciplina: dejá todo constante salvo la capa que estás testeando. Misma audiencia, mismo emplazamiento, misma oferta, misma landing. Cambiá el mensaje entre cuatro avisos manteniendo formato y ejecución comparables. Después, por separado, tomá el mensaje ganador y testeá formatos contra él.

Es más lento de lo que parece que debería ser, y es la única versión que acumula.

Estructura: un solo conjunto de anuncios

La discusión recurrente es si poner cada creatividad en su propio conjunto con su propio presupuesto, o todas en uno.

Para testear creatividades, poné todo en un solo conjunto. Razones:

  • Repartir presupuesto entre conjuntos reparte también la señal de conversión, y cada uno aprende más lento.
  • Conjuntos separados son subastas separadas y solapamientos de audiencia separados, así que ya no estás comparando lo mismo contra lo mismo.
  • La asignación de la plataforma es información. Va a mover presupuesto hacia lo que espera que rinda, y vos estás testeando creatividad, no tratando de adivinarle a la entrega.

La excepción es cuando necesitás un piso garantizado de impresiones por variante — por ejemplo, testeando algo estratégicamente importante donde la plataforma mataría una variante antes de que produzca datos. Ahí usá conjuntos separados, asumí el costo y sabé por qué lo estás haciendo.

En cualquier caso: no toques pujas, presupuestos ni audiencias a mitad del test. Cada cambio reinicia el aprendizaje e invalida la comparación.

Cuánto tiempo y cuánta plata

Las dos preguntas que casi todos responden mal.

Corré hasta que cada variante tenga conversiones suficientes para distinguirse del resto, no hasta una cantidad fija de días. Un piso útil son unas 50 conversiones por variante para una lectura confiable, y 25–30 para una direccional. Por debajo de eso estás leyendo ruido con seguridad.

Si tu cuenta no puede producir ese volumen por variante en una ventana razonable, tenés tres opciones honestas: testear menos variantes, testear sobre un evento de más volumen más arriba en el funnel (agregar al carrito en lugar de compra), o aceptar que tus lecturas son direccionales y dejar de pretender lo contrario.

Esperá a que termine la fase de aprendizaje y a que pase un ciclo de compra completo. Una lectura al día tres lee el comportamiento exploratorio de la plataforma, no el rendimiento de la creatividad. Si tu cliente típico tarda una semana en decidir, un test de siete días mide a la minoría impaciente.

Poné presupuesto suficiente para salir del aprendizaje. Un test subfinanciado no da una respuesta lenta: da una respuesta equivocada.

Las métricas que deciden

En orden de peso que deberían tener:

  1. Costo por resultado. Costo por compra, por lead calificado, por lo que el negocio necesite. Esto decide.
  2. Eficiencia a nivel cuenta después del cambio. ¿Mejoró la eficiencia combinada cuando moviste presupuesto al ganador, o el ganador simplemente le sacó presupuesto a algo que funcionaba? Ver cómo calcular el ROAS.
  3. Hook rate / thumbstop rate, para video. Útil como diagnóstico: te dice si un aviso perdió en el hook o más adelante. No debería decidir el ganador por sí solo.
  4. CTR. Diagnóstico nada más. CTR alto con conversión pobre suele significar que la creatividad prometió algo que la landing no cumplió.

Métricas que nunca deberían decidir un test creativo: impresiones, alcance, CPM, tasa de engagement, likes. Miden entrega y simpatía, no rendimiento.

Una trampa más: comparar formatos con métricas nativas de un formato. El video va a ganar en métricas de visualización que el estático directamente no puede producir. Eso está en estáticos vs video.

Una cadencia que puedas sostener

El testeo falla más por inconsistencia que por mal diseño. Un ritmo que funciona en la mayoría de las cuentas:

  • Semanal: revisar si algo del set activo se degradó lo suficiente como para pausarlo. Es mantenimiento, no testeo. Ver fatiga creativa.
  • Cada dos a cuatro semanas: un test estructurado con hipótesis escrita.
  • Trimestral: un test de mensaje más grande, y una revisión del registro.

Llevá un registro. Una fila por test: hipótesis, variable, variantes, resultado, qué concluiste. Lleva minutos y es lo único que evita que testees la misma idea por tercera vez en dieciocho meses. Casi nadie lo hace, y es el hábito de mayor retorno de todo el testeo creativo.

Escribí la hipótesis antes del test: “el video grabado por creador le va a ganar al video producido en audiencias frías porque se lee como recomendación y no como aviso”. Un test sin hipótesis escrita siempre se interpreta a favor de lo que ya creías.

La versión corta

Testeá mensaje antes que ejecución. Cambiá una capa por vez. Poné las variantes en un solo conjunto y dejá que la plataforma reparta. Corré hasta volumen de conversiones, no hasta una fecha. Decidí por costo por resultado y verificá a nivel cuenta. Escribí la hipótesis primero y registrá el resultado.

El objetivo no es encontrar el mejor aviso de este mes. Es saber algo en seis meses que tu competencia no sabe.

Si tu creatividad produce ganadores que no podés explicar, es el tipo de programa que ayudo a armar.