Il test standard
Un test z su due proporzioni con varianza aggregata, che è ciò che la maggior parte delle piattaforme di test A/B calcola dietro le quinte.
Strumenti / Calcolatore significatività statistica
Inserisci visitatori e conversioni per entrambe le varianti. Ottieni il valore p, l'incremento relativo e una risposta netta sulla significatività della differenza.
z = (p̂B − p̂A) ÷ √( p̄(1 − p̄)(1/nA + 1/nB) )
Inserisci valori per vedere il risultato
I visitatori che hanno visto il controllo e quanti di loro hanno convertito.
Gli stessi due numeri per la sfidante. Le conversioni non possono superare i visitatori.
Ottieni entrambi i tassi di conversione, l'incremento relativo, la statistica z, il valore p e se supera 0,05.
Che la variante B sia avanti non è come dire che la variante B sia migliore. Questo separa una differenza reale dal rumore ordinario.
Un test z su due proporzioni con varianza aggregata, che è ciò che la maggior parte delle piattaforme di test A/B calcola dietro le quinte.
Un incremento significativo dello 0,2% e uno non significativo del 40% richiedono decisioni molto diverse. Vengono mostrati entrambi i numeri.
Il verdetto usa la soglia convenzionale di 0,05 e lo dichiara, invece di nascondere il valore p dietro un'etichetta.
Confronta i tassi di iscrizione o acquisto tra due versioni di pagina.
Verifica se una differenza nel tasso di apertura o di clic è più che rumore.
Confronta il tasso di sì tra due formulazioni della stessa domanda.
z = (p̂_B − p̂_A) ÷ √( p̄(1 − p̄) × (1/n_A + 1/n_B) ) dove p̄ = (x_A + x_B) ÷ (n_A + n_B)
p̄ è il tasso di conversione aggregato tra le due varianti, usato perché l'ipotesi nulla è che i due tassi siano uguali. Il valore p è la probabilità normale a due code per quello z.
Usa un test z su due proporzioni. Aggrega i tassi di conversione tra le due varianti, calcola l'errore standard della differenza, dividi la differenza osservata per esso e converti quello z in un valore p a due code.
Se p è sotto 0,05, la differenza si dice convenzionalmente statisticamente significativa.
Che una differenza così ampia sarebbe improbabile se le due varianti rendessero davvero allo stesso modo. Non significa che la differenza sia grande o che conti sul piano commerciale.
Leggi sempre l'incremento accanto al valore p prima di decidere di rilasciare.
Dipende dal tuo tasso di base e dal più piccolo incremento che vale la pena rilevare. Rilevare un piccolo incremento relativo su un tasso di base basso può richiedere decine di migliaia di visitatori per variante.
Il calcolatore dimensione campione dà una cifra di partenza per un margine di errore obiettivo.
No. Sbirciare ripetutamente e fermarsi al primo risultato verde gonfia il tuo tasso di falsi positivi ben oltre il 5%.
Fissa in anticipo la dimensione campionaria, arrivaci e poi leggi il risultato una volta sola.
Il verdetto usa il livello standard del 95%, cioè p < 0,05. Il valore p esatto è sempre mostrato, così puoi applicare una soglia più severa se il tuo contesto lo richiede.
Non hai prove sufficienti che le varianti differiscano. Non è la prova che siano uguali. O continui fino a un campione più grande o accetti che una differenza reale sia probabilmente troppo piccola per valere la pena.
Non direttamente. Confrontare più varianti insieme alza la probabilità di un falso positivo, quindi serve un aggiustamento o un test complessivo. Il calcolatore chi quadrato gestisce una tabella di conversioni multivariante.
No. Tutto gira nel tuo browser.
Raccogli risposte fresche a un sondaggio? Prova Formms per un modulo con link corto e QR.
Formms costruisce il sondaggio da un prompt, poi puoi incollare i conteggi in questi calcolatori quando vuoi.
Vedi un modulo demo →