Nettoyage et enrichissement d’une base HubSpot de 135 000 contacts

135 000 contacts nettoyés et enrichis en 13 jours

Une PME SaaS de 50 personnes avait accumulé cinq ans de données dans HubSpot. Deux tiers de la base était inexploitable et la délivrabilité commençait à en souffrir.

135 000 contacts repris en 13 jours
12 % → 3 % de taux de rebond sur les campagnes email
0 donnée existante écrasée

Le contexte

Une base qui grossit plus vite qu’elle ne se met à jour

Cinq ans de croissance, 135 000 contacts dans HubSpot, et aucun mécanisme pour maintenir la fraîcheur de l’information. Un diagnostic de la base a identifié 87 450 fiches avec des données manquantes ou périmées, soit près de deux tiers du total : postes qui ne correspondent plus, personnes parties ailleurs, coordonnées invalides.

La conséquence la plus visible était la délivrabilité. Avec 12 % de rebond sur les campagnes, la réputation d’expéditeur se dégradait, ce qui menaçait la capacité à atteindre y compris les contacts encore valides.

La conséquence la plus coûteuse était ailleurs. Les commerciaux passaient environ 40 % de leur temps à rechercher manuellement la bonne information, soit de l’ordre de 280 heures par mois à l’échelle de l’équipe. Et sans données fiables, impossible de prioriser les comptes à forte valeur autrement qu’à l’intuition.

Notre diagnostic

Quatre décisions prises avant le premier enrichissement

Qualifier avant d’enrichir, jamais l’inverse

Enrichir toute la base revient à payer pour des contacts hors cible. Les critères ICP sont donc contrôlés en premier : 18 750 contacts ont été marqués hors scope et n’ont jamais consommé un seul crédit d’enrichissement.

Ne jamais écraser une donnée existante

Règle d’écriture stricte : un champ n’est rempli que s’il est vide. Un enrichissement qui écrase une information juste coûte plus cher que le vide qu’il comble, et la confiance de l’équipe dans sa base ne se rattrape pas.

Aucune source ne couvre tout

Choisir un fournisseur unique, c’est accepter ses trous de couverture. D’où un enrichissement en cascade, où l’on interroge les sources successivement et où l’on s’arrête à la première réponse valide.

L’identifiant HubSpot comme clé unique

Travailler par export et réimport CSV crée des doublons à chaque cycle. La connexion est native et l’ID HubSpot sert de clé de rapprochement de bout en bout.

Le déploiement

Cinq phases, dans cet ordre

Phase 1 · jours 1 à 2 01

Audit et connexion

Diagnostic complet de la base pour isoler les 87 450 fiches à traiter, puis priorisation des champs à forte valeur : titre, email vérifié, LinkedIn, téléphone, taille d’entreprise. Les valeurs aberrantes du type « unknown », « N/A » ou « 1234 » sont purgées avant tout traitement.

Connexion native entre HubSpot et l’outil d’orchestration, listes actives segmentées par manque constaté, et import avec l’ID HubSpot comme clé unique.

Diagnostic Listes actives Clé unique
Phase 2 · jours 2 à 5 02

Validation ICP et vérification des postes

Chaque contact passe d’abord un contrôle de cible sur la taille, le secteur, le poste et la localisation. Hors ICP, il est marqué et sort du circuit. Dans l’ICP, il continue.

Les contacts retenus sont ensuite confrontés à LinkedIn pour savoir si la personne occupe toujours le même poste. Changement de fonction seule ou changement d’entreprise, la mise à jour diffère.

Hors ICP18 750 contacts exclus
Dans l’ICP116 250 contacts traités
Postes corrigés23 400 contacts
Contrôle ICP Vérification LinkedIn
Phase 3 · la plus lourde 03

Enrichissement en cascade et nettoyage

Trois cascades, une par type de donnée. Les emails passent par Fullenrich, puis Icypeas, puis People Data Labs. Les titres par LinkedIn, Apollo, LeadMagic. Les téléphones par LeadMagic, Fullenrich, Nimbler. La cascade s’interrompt dès qu’une source répond valablement, ce qui évite de payer plusieurs fois la même information.

Vient ensuite la normalisation. Les titres sont harmonisés et débarrassés de leurs parenthèses, les téléphones ramenés à un format international unique. Puis le filtre qualité : exclusion des doublons, validation des emails, et suppression de 11 234 adresses invalides avant le moindre envoi.

Complétude atteinte : 76 à 89 % selon les champs, sans un seul doublon créé.

Cascade multi-sources Normalisation Validation email
Phase 4 04

Écriture protégée et traçabilité

L’écriture vers HubSpot n’a lieu que sur les champs vides. La règle a été testée sur 100 contacts avant le déploiement massif, et aucune donnée existante n’a été écrasée sur l’ensemble du chantier.

Chaque fiche porte la trace de son lot d’origine, et des rapports suivent les champs enrichis et le taux de complétude. Un échantillon de 2 à 5 % est relu à la main pour contrôler la qualité réelle, pas seulement le volume.

Écriture si vide Test préalable Échantillonnage
Phase 5 · en continu 05

Maintenance automatisée

Un chantier de nettoyage sans entretien redevient une base sale en dix-huit mois. Cycle mensuel sur les nouveaux contacts, audit trimestriel des doublons et réajustement des cascades selon la performance réelle de chaque fournisseur.

Règle d’économie intégrée : aucun contact n’est ré-enrichi si sa date de dernier enrichissement a moins de 30 jours.

Cycle mensuel Audit trimestriel

Les résultats

Ce qui a changé pour l’équipe

La délivrabilité est repassée dans le vert

Le taux de rebond est passé de 12 % à 3 %, divisé par quatre. La réputation d’expéditeur n’est plus le facteur limitant des campagnes.

Une base exploitable à 76-89 % selon les champs

Titre, email vérifié, LinkedIn et téléphone sont présents sur la grande majorité des fiches de l’ICP. Le ciblage repose sur des données, plus sur des souvenirs.

Aucune donnée perdue au passage

Zéro écrasement sur 135 000 contacts. C’est le résultat qui ne se voit pas, et celui qui décide si l’équipe fait confiance à sa base après l’opération.

Le temps de recherche manuelle s’effondre

Les 280 heures mensuelles passées à retrouver la bonne information n’ont plus d’objet quand l’information est dans la fiche.

Une prise de rendez-vous multipliée par 4,5

Effet combiné d’une meilleure délivrabilité et d’un ciblage enfin fondé sur des critères vérifiés.

Un CRM qui reste propre sans intervention

Les cycles de maintenance tournent seuls. Le nettoyage n’est pas une opération ponctuelle à refaire dans deux ans, c’est un régime permanent.

Récapitulatif

Ce qui a été livré

BriqueCe qui a été mis en placeOutil
DiagnosticIdentification des fiches incomplètes, priorisation des champs, purge des valeurs aberrantesHubSpot
ConnexionIntégration native sans export manuel, ID HubSpot comme clé de rapprochementHubSpot ↔ Clay
QualificationContrôle ICP avant enrichissement, exclusion des contacts hors cibleRègles automatisées
VérificationContrôle du poste occupé et détection des changements d’entrepriseLinkedIn
EnrichissementTrois cascades, arrêt à la première source valideFullenrich, Icypeas, People Data Labs, Apollo, LeadMagic, Nimbler
NormalisationHarmonisation des titres et des formats de téléphoneClaygent
Filtre qualitéDéduplication et validation des adresses avant envoiZeroBounce
ÉcritureMise à jour des champs vides uniquement, test préalable sur 100 contactsAPI HubSpot
TraçabilitéMarquage du lot d’origine, rapports de complétude, échantillonnage manuelHubSpot
MaintenanceCycle mensuel, audit trimestriel, règle anti-ré-enrichissementAutomatisation

Votre base a grossi plus vite que votre capacité à la tenir à jour ?

Un échange de trente minutes pour mesurer l’état réel de votre CRM et dire ce qu’un nettoyage changerait sur vos campagnes.

Déployer ce système chez vous