Dividir el archivo arriba vs abajo - el test ya está roto. El CRM ordena por fecha de alta: «arriba» suele ser más fresco y cálido que «abajo». Si A supera a B diez veces, no ganó el texto - ganó la edad de la audiencia.
La mayoría de «A/B» en WhatsApp no son tests: dos textos, dos audiencias, horarios distintos, varias variables a la vez. Resultado convincente, pero no responde «qué texto funciona».
En 2026 cuesta más: WABA califica cada plantilla; quejas en un variant → Low Quality; sin randomización quemas números - ver WABA.
A/B = dos variantes en segmentos comparables, un solo elemento distinto. Cambiar oferta, longitud, CTA y hora juntos = adivinar.
No hay split-test automático en WhatsApp Business Suite. Todo depende del marketer y CRM externo.
Tercer patrón: 5–10 textos distintos desde un número «para ir más rápido» - Meta lo lee como script spam - ver bans.
Primera mitad → A, segunda → B = división cronológica, no random.
Mini caso. 2000 clientes: 1000 del mes → A (35%), 1000 de dos años → B (2% + ban). Comparó cálido vs frío - ver base cálida vs fría.
Solución: mezclar antes de dividir - ver segmentación.
Un elemento por test: saludo, pregunta final, longitud, {{1}}. Cuerpo idéntico.
200 = orientación operadores, no estándar estadístico. Playbooks: 500+ más fiable. Grupos 30–50 = ruido.
Solo 200 → hipótesis, no veredicto final.
Primer contacto: clics no existen como métrica - enlaces no clicables de números desconocidos hasta guardar/responder.
Response Rate y diálogos iniciados - KPI primer contacto - ver dashboard.
Read Rate poco fiable - ver leyó y no respondió.
| Métrica | Primer contacto |
|---|---|
| Response Rate | Alta |
| Read Rate | Baja |
| CTR enlace | Inútil paso 1 |
| Reportes | Crítica WABA |
Quejas > 0,1–0,2% → Low Quality. Alto response + quejas subiendo ≠ ganador.
Mismo día y hora A y B. Misma velocidad y delays. Semántica muy distinta puede flaggear seguridad.
1000 fríos retail → 500+500 random. A: pitch + enlace 1,2%, 2 números reportados. B: pregunta situacional 29%, sin bans. Pitch completo en paso 2.
Foro - sin verificación pública.
200–500 confirma reacción inicial. Escala por etapas - ver texto vs cuenta.
Revisa split actual: ¿cómo se dividió la base? ¿Cuántas variables? Si dudas - recalcula, no escales.
Regla:
Sin randomización no hay A/B - hay comparar dos audiencias que parece comparación de textos.