Herramienta 01 · CRO
La mayoría no puede, y casi nadie lo revisa antes de contratar el servicio. Pon tu tráfico real y te digo cuánto tardaría el test — y si no sale, qué hacer en su lugar.
La fila marcada es la mejora más pequeña que cabe en 8 semanas.
| Mejora | Visitas/variante | Duración | Veredicto |
|---|
Es el mismo trabajo útil con la etiqueta correcta. Quien te venda A/B testing con este tráfico te va a entregar un «ganador» que es ruido.
Método
Prueba de dos proporciones a dos colas. La misma fórmula que usan Evan Miller, Optimizely y VWO en sus calculadoras públicas.
n = (Zα/2 + Zβ)² · [p₁(1−p₁) + p₂(1−p₂)]
─────────────────────────────────
(p₂ − p₁)²
p₁ = tasa actual
p₂ = p₁ · (1 + mejora)
Piso de 100 conversiones por variante. Por debajo de eso, un ganador es ruido aunque el cálculo diga que ya alcanzaste la muestra. Cuando este piso manda sobre la fórmula, la herramienta lo marca.
Techo de 8 semanas. Más allá, la estacionalidad y la pérdida de cookies contaminan el resultado. Y el mínimo son 2 semanas: menos no captura un ciclo semanal completo.
No corrige por comparaciones múltiples. Con 3 o 4 variantes, la probabilidad de un falso positivo sube por encima del α que elegiste — la corrección de Bonferroni pediría dividir α entre el número de comparaciones y eso engorda la muestra.
Tampoco contempla tests secuenciales ni métodos bayesianos, que permiten mirar el resultado antes sin romper la validez.