Construire des modèles de prédiction du churn à partir du comportement des abonnés
# Construire des modèles de prédiction du churn à partir du comportement des abonnés
Une abonnée prépayée qui rechargeait chaque semaine ne recharge plus qu'une fois par mois. Mardi dernier, elle a déposé sa deuxième réclamation pour appel coupé. Hier, un numéro de son indicatif régional a été porté chez un concurrent. Aucun de ces signaux n'est alarmant isolément. Ensemble, ils décrivent une abonnée qui fait discrètement ses valises.
Votre travail : le voir avant qu'elle ne parte.
Pourquoi le churn est le chiffre qui empêche les CFO du télécom de dormir
Le churn est le taux de départ des abonnés sur une période, généralement exprimé au mois. Sur les marchés prépayés, il est brutal. Pas de contrat, pas de frais de résiliation anticipée, et un coût de changement quasi nul grâce à la portabilité du numéro mobile (MNP), le dispositif réglementaire qui permet à un abonné de conserver son numéro en changeant d'opérateur.
Acquérir un nouvel abonné coûte bien plus cher que d'en conserver un. Le constat est largement repris dans le secteur, et c'est pour cela que la rétention reçoit de vrais budgets. Si vous parvenez à signaler un abonné high-value à risque quelques semaines à l'avance, une équipe de rétention peut intervenir : un bonus data ciblé, une offre de fidélité, un appel du service client.
Toute la difficulté est dans le ciblage. Arrosez tout le monde de remises et vous érodez la marge sur des gens qui n'allaient jamais partir. Un bon modèle de churn vous dit *qui*, *avec quelle probabilité*, et idéalement *pourquoi*.
TransformerTransformerUn Transformer est une architecture de réseau de neurones qui utilise le self-attention pour traiter des séquences en parallèle. Elle est au cœur de la plupart des modèles de langage et d'IA générative actuels.Voir la définition complète → le comportement en features
Un modèle ne vaut que ses entrées. En machine learning, une feature est une variable d'entrée mesurable. Les données télécom brutes ne sont pas des features ; ce sont des call detail records, des logs de recharge et des tickets de réclamation. Il faut en extraire du signal.
Voici les catégories qui comptent pour notre opérateur prépayé.
Comportement de recharge et de dépense
Le signal prépayé le plus fort est la recharge. Un profil de recharge en déclin est le meilleur indice de « je m'en vais » qui existe.
Features utiles :
- Nombre de jours depuis la dernière recharge
- Fréquence de recharge du mois versus moyenne des trois mois précédents
- Montant moyen de recharge et sa tendance
- Vitesse d'épuisement du solde (laissent-ils le solde s'assécher sans le recharger ?)
La *tendance* compte plus que le *niveau*. Un abonné qui recharge toujours mensuellement va bien. Un abonné passé de l'hebdomadaire au mensuel, c'est l'alarme.
Comportement d'usage
- Minutes voix, nombre de SMS et volume data, chacun en tendance
- Nombre de correspondants uniques appelés (un cercle social qui se réduit sur votre réseau précède souvent un changement)
- Part d'appels off-net : si davantage de leurs appels partent vers *d'autres* réseaux, leurs proches sont peut-être déjà partis, et les effets de réseau les entraînent
Expérience réseau
C'est ici qu'entrent les réclamations pour appels coupés. Une mauvaise expérience accélère le churn.
- Nombre d'appels coupés par semaine
- Tickets de réclamation déposés et leur résolution ou non
- Sites cellulaires les plus utilisés par l'abonné, croisés avec les problèmes connus de couverturecouvertureLe nombre de personnes uniques exposées à votre message sur une période donnée. Contrairement aux impressions, le reach compte chaque personne une seule fois, quel que soit le nombre d'expositions.Voir la définition complète → ou de congestion
Si l'antenne de son domicile connaît un problème de congestion et qu'il a déposé deux réclamations, c'est un risque cumulatif que vous pouvez littéralement cartographier.
Signaux concurrentiels et de marché
Les données de portabilité MNP valent de l'or. Les régulateurs et les chambres de compensation publient l'activité de portabilité, et les opérateurs suivent les demandes de port-out quasiment en temps réel.
- Flag de demande de port-out (un abonné qui a lancé une portabilité a déjà un pied dehors)
- Vélocité locale de portabilité : la zone postale de l'abonné connaît-elle un pic de ports vers un concurrent, peut-être parce qu'un rival vient de lancer une offre agressive ?
Valeur et ancienneté
Tous les churns ne se valent pas. Perdre un abonné high-value fait plus mal.
- ARPU (Average Revenue Per User), la mesure télécom standard du revenu par abonné et par période
- Ancienneté en mois (les abonnés récents churnent davantage)
- Appartenance au décile supérieur de revenu (votre flag « high-value »)
Cadrer le modèle
C'est un problème de classification binaire : pour chaque abonné, prédire la probabilité qu'il churne dans une fenêtre future définie.
Définissez le churn précisément. En prépayé, une définition courante est l'absence d'activité génératrice de revenu pendant un nombre donné de jours consécutifs (disons 30 ou 60), puisqu'il n'y a pas d'événement formel de résiliation. Choisissez la fenêtre, documentez-la, et tenez-vous-y.
Construisez ensuite un jeu de données labellisé. Prenez un snapshot des features à un instant donné, puis regardez vers l'avant pour voir qui a effectivement churné. Cette fenêtre future est votre label.
# Illustratif : churn labellisé comme absence d'activité dans les 30 jours suivants
import pandas as pd
df['label_churn'] = (df['days_to_next_activity'] > 30).astype(int)
features = [
'days_since_last_topup',
'topup_freq_ratio_3m', # ce mois vs moyenne 3 mois
'data_volume_trend',
'dropped_calls_7d',
'unresolved_complaints',
'offnet_call_share',
'port_out_flag',
'area_port_velocity',
'arpu',
'tenure_months',
]
X = df[features]
y = df['label_churn']Commencez simple. Une régression logistique (un modèle qui sort une probabilité entre 0 et 1) ou un modèle de gradient boosting sur arbres comme XGBoost s'en sort très bien et, surtout, vous permet d'expliquer quelles features ont produit chaque score. L'explicabilité compte quand un responsable rétention demande « pourquoi cette personne est-elle signalée ? ».
Pour une base solide et gratuite sur le workflow de modélisation, le Machine Learning Crash Course de Google traite proprement la classification et l'évaluation.
🎬 [VIDEO: "Customer ChurnCustomer ChurnLe churn rate est le pourcentage de clients ou de revenus perdus sur une période. Il mesure la vitesse à laquelle une entreprise perd sa base de clients existante.Voir la définition complète → Prediction Explained" - youtube.com - présentation du cadrage du churn en classification et de l'engineering de features comportementales]
Scoring, seuils et passage à l'action
Le modèle sort une probabilité. La transformertransformerUn Transformer est une architecture de réseau de neurones qui utilise le self-attention pour traiter des séquences en parallèle. Elle est au cœur de la plupart des modèles de langage et d'IA générative actuels.Voir la définition complète → en action demande deux décisions de plus.
Où placez-vous le seuil ? Un abonné scoré à 0,82 est à haut risque. Mais agissez-vous à 0,5 ? À 0,7 ? C'est une décision business, pas une décision mathématique. Des seuils élevés donnent moins de flags, plus fiables (vous manquez des partants). Des seuils bas attrapent plus de partants mais gaspillent des offres sur de fausses alertes.
Comment classez-vous ? Combinez probabilité de churn et valeur. Un abonné à 0,6 de probabilité et fort ARPU peut mériter une intervention avant un abonné à 0,9 et dépense minime. Une approche simple est un score de perte attendue :
priority = churn_probability * monthly_ARPU
Cela fait naturellement remonter les abonnés *high-value* à risque dont parle notre accroche.
Évaluer honnêtement le modèle
N'utilisez pas l'accuracy brute. Les churners sont une minorité : un modèle qui prédit « personne ne churne » peut sembler précis et ne servir à rien.
Utilisez :
- Precision : parmi ceux que nous avons signalés, combien ont réellement churné
- Recall : parmi ceux qui ont churné, combien nous en avons attrapé
- Lift : de combien le segment le mieux scoré fait mieux qu'un ciblage aléatoire
Le lift est la métrique que les équipes de rétention comprennent instantanément. Si les 10 % du haut de votre liste scorée contiennent quatre fois plus de churners que 10 % pris au hasard, c'est un lift de 4x, et c'est la valeur que vous présentez au CFO.
Vérification des acquis
1. Pourquoi le churn est-il considéré comme particulièrement sévère sur les marchés prépayés par rapport aux marchés sous contrat ?
2. La leçon soutient qu'un bon modèle de churn doit identifier « qui, avec quelle probabilité, et pourquoi » plutôt que de signaler le risque de façon large. Quelle est la principale raison business de cette précision ?
3. En termes de machine learning, pourquoi les call detail records, logs de recharge et tickets de réclamation bruts ne peuvent-ils PAS être injectés directement tels quels dans un modèle de churn ?
4. Sélectionnez TOUTES les bonnes réponses. Selon la leçon, lesquelles des propositions suivantes sont des features engineerées pertinentes issues du comportement de recharge et de dépense ?
Sélectionnez toutes les réponses correctes.
5. Sélectionnez TOUTES les bonnes réponses. Le scénario d'ouverture décrit une abonnée dont les signaux individuels sont banals mais qui, ensemble, suggèrent un churn imminent. Quels principes de la détection du churn cela illustre-t-il ?
Sélectionnez toutes les réponses correctes.
Du modèle au programme de rétention
Un score posé dans une base de données ne sauve personne. Le modèle doit alimenter une boucle opérationnelle.
1. Scorez régulièrement. Le comportement prépayé bouge vite : un scoring hebdomadaire, voire quotidien, vaut mieux que mensuel. Un signal de solde à sec est périssable.
2. Routez par segment. Les abonnés high-value à haut risque peuvent recevoir un appel proactif du service client. Le milieu de gamme, une offre SMS automatisée. Le bas de gamme, rien du tout, et c'est un choix valide.
3. Alignez l'offre sur le driver. C'est là que les features explicables paient. Si le flag est porté par les appels coupés, une remise ne réglera pas un problème de couverturecouvertureLe nombre de personnes uniques exposées à votre message sur une période donnée. Contrairement aux impressions, le reach compte chaque personne une seule fois, quel que soit le nombre d'expositions.Voir la définition complète →, mais une reconnaissance du problème plus un calendrier de correction réseau, peut-être. Si c'est l'offre data moins chère d'un concurrent, un bonus data ciblé est le bon levier.
4. Gardez un groupe de contrôle. Conservez toujours un groupe d'abonnés à risque sélectionnés aléatoirement qui ne reçoivent aucune intervention. Comparez leur churn à celui du groupe traité. Sans contrôle, vous ne pouvez pas prouver que le programme a fonctionné, et vous payez peut-être pour retenir des gens qui seraient restés de toute façon.
Un déroulé concret
Revenons à notre abonnée. Son vecteur de features : jours depuis la dernière recharge en hausse, ratio de fréquence de recharge à 0,25 (elle recharge quatre fois moins souvent qu'avant), deux réclamations d'appels coupés non résolues, part d'appels off-net en hausse, et sa zone postale affiche une vélocité de portabilité élevée vers un concurrent. ARPU dans le décile supérieur.
Sa probabilité de churn ressort à 0,78. Multipliée par son ARPU, elle se place tout en haut de la liste de priorité. Les features dominantes sont l'effondrement des recharges et les réclamations non résolues.
L'action s'écrit presque d'elle-même : un agent l'appelle, résout la réclamation de couverturecouvertureLe nombre de personnes uniques exposées à votre message sur une période donnée. Contrairement aux impressions, le reach compte chaque personne une seule fois, quel que soit le nombre d'expositions.Voir la définition complète → (ou explique le calendrier de correction), et propose un bonus data de fidélité. Si le port vers le concurrent était motivé par le prix, elle a maintenant une raison de rester. Vous êtes intervenu pendant qu'elle hésitait encore, pas après qu'elle a porté son numéro.
Points clés
- Les signaux de churn prépayé les plus forts sont des tendances comportementales, en particulier la baisse de fréquence de recharge, pas des snapshots statiques. Modélisez la variation, pas le niveau.
- Construisez des features sur cinq blocs : recharge, usage, expérience réseau, signaux concurrentiels et de portabilité MNP, et valeur de l'abonné.
- Classez par perte attendue (probabilité de churn × ARPU) pour que la dépense de rétention cible les abonnés high-value à risque, et non tout le monde.
- Jugez le modèle sur la precision, le recall et le lift, jamais sur l'accuracy brute, car les churners sont une classe minoritaire.
- Un score ne vaut rien sans boucle opérationnelle : scorez fréquemment, alignez l'offre sur le driver de churn, et gardez toujours un groupe de contrôle pour prouver l'impact.