Nous mesurons le succès de l'optimisation du taux de conversion (CRO) à trois niveaux, et notre indicateur principal est le revenu par visiteur (RPV), et non le taux de conversion seul. Le taux de conversion peut augmenter tandis que la valeur moyenne des commandes diminue, ce qui maintient le chiffre d'affaires total stable. Le RPV permet de combler cet écart. Au niveau des tests, nous communiquons l'augmentation du trafic, la fiabilité statistique et le chiffre d'affaires additionnel. Chaque test est exécuté sur des cycles d'activité complets afin que les variations liées aux jours ouvrables, aux jours de paie et aux campagnes n'influencent pas les résultats. Nous définissons l'effet minimal détectable et la taille d'échantillon requise avant le lancement du test, et non après analyse des données. Au niveau du programme, nous suivons la fréquence des tests, le taux de réussite, l'augmentation moyenne par test concluant et le chiffre d'affaires additionnel annualisé cumulé sur 6 à 12 mois. Un test isolé peut être dû à la chance ; un an de résultats de programme, non. C'est également le chiffre qui répond à la seule question qu'un directeur financier se pose réellement : le chiffre d'affaires additionnel annualisé par rapport au coût du programme. Parallèlement, nous suivons des indicateurs de performance clés (valeur moyenne des commandes, taux de retour et d'annulation, volume de tickets d'assistance et performance des pages) afin qu'un test concluant ne se traduise jamais par un transfert de coûts vers un autre poste de l'entreprise. Nous comptabilisons également les tests infructueux comme des résultats. Une variante moins performante correspond à une décision de lancement que vous n'avez pas prise et aux revenus que vous n'avez pas perdus, validée en trois semaines au lieu d'être découverte en un trimestre. Chaque test fait l'objet d'un rapport comprenant son hypothèse, ses données et la décision qu'il a permis d'éclairer, qu'il ait été concluant ou non. Rien de tout cela n'est possible sans une base de référence bien définie. Avant chaque exécution de test, nous validons la configuration analytique et établissons le référentiel pré-programme ; nous ne revendiquons aucune amélioration sur des chiffres que nous n'avons pas pu mesurer au préalable.