Prueba A/B en WhatsApp: cómo testear envíos sin engañarse
AndySendy academy
← Todas las entradas

🧪 Prueba A/B en WhatsApp que no miente

Dividir el archivo arriba vs abajo - el test ya está roto. El CRM ordena por fecha de alta: «arriba» suele ser más fresco y cálido que «abajo». Si A supera a B diez veces, no ganó el texto - ganó la edad de la audiencia.

La mayoría de «A/B» en WhatsApp no son tests: dos textos, dos audiencias, horarios distintos, varias variables a la vez. Resultado convincente, pero no responde «qué texto funciona».

En 2026 cuesta más: WABA califica cada plantilla; quejas en un variant → Low Quality; sin randomización quemas números - ver WABA.


A/B vs caos

A/B = dos variantes en segmentos comparables, un solo elemento distinto. Cambiar oferta, longitud, CTA y hora juntos = adivinar.

No hay split-test automático en WhatsApp Business Suite. Todo depende del marketer y CRM externo.

Tercer patrón: 5–10 textos distintos desde un número «para ir más rápido» - Meta lo lee como script spam - ver bans.


Error #1: partir la base por la mitad

Primera mitad → A, segunda → B = división cronológica, no random.

Mini caso. 2000 clientes: 1000 del mes → A (35%), 1000 de dos años → B (2% + ban). Comparó cálido vs frío - ver base cálida vs fría.

Solución: mezclar antes de dividir - ver segmentación.


Regla de una variable

Un elemento por test: saludo, pregunta final, longitud, {{1}}. Cuerpo idéntico.


¿200 o 500 contactos por variant?

200 = orientación operadores, no estándar estadístico. Playbooks: 500+ más fiable. Grupos 30–50 = ruido.

Solo 200 → hipótesis, no veredicto final.


Métrica ganadora

Primer contacto: clics no existen como métrica - enlaces no clicables de números desconocidos hasta guardar/responder.

Response Rate y diálogos iniciados - KPI primer contacto - ver dashboard.

Read Rate poco fiable - ver leyó y no respondió.

Métrica Primer contacto
Response Rate Alta
Read Rate Baja
CTR enlace Inútil paso 1
Reportes Crítica WABA

Quejas > 0,1–0,2% → Low Quality. Alto response + quejas subiendo ≠ ganador.


Lanzamiento correcto

Mismo día y hora A y B. Misma velocidad y delays. Semántica muy distinta puede flaggear seguridad.


Mini caso

1000 fríos retail → 500+500 random. A: pitch + enlace 1,2%, 2 números reportados. B: pregunta situacional 29%, sin bans. Pitch completo en paso 2.

Foro - sin verificación pública.


Ganar ≠ escalar ya

200–500 confirma reacción inicial. Escala por etapas - ver texto vs cuenta.


Checklist

  1. Random, no posición en lista
  2. Una variable
  3. 200–500+ por variant
  4. Mismo día/hora
  5. Misma velocidad
  6. Response Rate, no read/clics
  7. Quejas por variant ≤ 0,1–0,2%
  8. No parar pronto

🎯 Siguiente paso

Revisa split actual: ¿cómo se dividió la base? ¿Cuántas variables? Si dudas - recalcula, no escales.

Conclusión

Regla:

Sin randomización no hay A/B - hay comparar dos audiencias que parece comparación de textos.