Vragen · Adressen
Hoe verifieer en corrigeer je een klantenbestand?
Het corrigeren van een klantenbestand is werk in drie stappen, in de juiste volgorde: eerst worden de adressen in hun juiste vorm gezet, dan worden de dubbele records herkend, ten slotte worden de contactgegevens van elk record gecontroleerd. Elke wijziging wordt benoemd, veld voor veld, en de beslissingen die een oordeel vragen blijven bij wie de klanten kent.
Wat corrigeren van een bestand betekent
Een klantenbestand veroudert vanzelf: wie gegevens invoert heeft haast, wie een lijst importeert verwisselt kolommen, wie aan de telefoon zit schrijft de naam op het gehoor. Na een paar jaar bevat hetzelfde bestand adressen die op tien manieren zijn afgekort, dezelfde persoon op twee of drie records, e-mailadressen met een typefout in het domein en telefoonnummers met het netnummer half geschreven. Geen van die fouten is op zichzelf ernstig. Samen zorgen ze ervoor dat post terugkomt, dat dezelfde mailing twee keer wordt verstuurd en dat de cijfers van de campagnes opgeblazen zijn.
Corrigeren betekent niet de onvolmaakte records verwijderen. Het betekent elk gegeven in zijn juiste vorm terugbrengen waar dat kan, aangeven wat niet met zekerheid te reconstrueren is, en de records die over dezelfde persoon gaan samenvoegen zonder iets te verliezen van wat ze bevatten. Het resultaat is een bestand waarop een campagne, een factuur of een zoekopdracht op naam het verwachte resultaat geeft.
De volgorde van de drie stappen, en waarom die telt
Eerst: de adressen. Straat voluit, huisnummer op zijn plaats met de toevoeging erachter, postcode die bij het huisnummer hoort, plaats in de officiële vorm. Hier begin je omdat al het andere op het adres steunt: twee records met “Kalverstr. 92” en “Kalverstraat 92” lijken verschillend zolang het adres niet op dezelfde manier geschreven is.
Dan: de dubbele records. Met de adressen rechtgezet herkent de vergelijking tussen de records dezelfde persoon, ook met een afgekorte voornaam, achternaam en voornaam omgewisseld of een typefout. Elke groep dubbele records krijgt een zekerheidsniveau en de reden van de koppeling, en stelt het hoofdrecord voor met het beste veld uit elk record.
Ten slotte: de contactgegevens. E-mailadres met het juiste domein, telefoonnummer in de nationale vorm met het herkende type (mobiel of vast), website die echt antwoordt. Het zijn controles per record: je doet ze aan het einde, als de records al de juiste zijn, zodat je hetzelfde contact niet twee keer verifieert.
Wat een correctie niet mag doen
- Verzinnen. Als een straat niet in de gemeente voorkomt of het huisnummer ontbreekt, zegt de uitkomst dat en laat ze de beslissing aan jou. Een aannemelijk adres dat aan het bureau is bedacht, is erger dan een adres dat als onzeker is gemarkeerd.
- Zelf verwijderen. Dubbele records worden gemeld met het oordeel en het voorgestelde hoofdrecord. Twee records samenvoegen of apart houden is een keuze van wie de klanten kent.
- Afkeuren om een typefout. Een e-mailadres met “gmial.com” is geen verloren contact: het is een contact met de voorgestelde correctie ernaast.
- In stilte werken. Elk gewijzigd veld moet de waarde van ervoor, die van erna en de reden naast zich hebben. Zonder dat is de correctie niet te controleren en niet uit te leggen aan wie ervoor betaalt.
Hoe het in de praktijk gaat met RadarAddress
Je exporteert het bestand naar Excel of CSV met de kolommen die je hebt: achternaam, voornaam, straat en huisnummer, postcode, plaats, e-mailadres, telefoonnummer. Voorbereiden hoeft niet: bij het uploaden worden scheidingsteken, tekencodering en kolomkoppen herkend. Voordat de opdracht start zie je een voorbeeld van de rijen en hoeveel bewerkingen ze vraagt; de bewerkingen worden pas afgeschreven als je bevestigt.
De eerste opdracht is de contactverificatie, die het adres rechtzet en in dezelfde rij de naam controleert. De tweede, op hetzelfde bestand, is het ontdubbelen, dat elke rij teruggeeft met de groep waartoe ze hoort en het record om te bewaren. E-mailadressen, telefoonnummers en websites verifieer je met de opdrachten daarvoor, één element per keer. In elk resultaatbestand vind je per rij de uitkomst, de juiste vorm en wat er veranderd is; het overzicht aan het einde van de opdracht vat de uitkomsten per categorie samen, zodat je meteen weet hoeveel rijen in orde waren, hoeveel er gecorrigeerd zijn en hoeveel je met de hand moet bekijken.
Wie vanuit code werkt heeft dezelfde drie stappen in de API: één endpoint per dienst, enkel of in lijsten, en de asynchrone opdracht voor grote bestanden. Om het goed voor te bereiden is er de gids voor het bestand; de prijslijst staat op de prijzenpagina.
Hoe je het resultaat meet
Een correctie beoordeel je op de cijfers van ervoor en erna, niet op gevoel. De nuttige cijfers zijn er maar een paar: hoeveel rijen een adres hadden dat de engine moest corrigeren, hoeveel er overblijven met een uitkomst om te bekijken, hoeveel groepen dubbele records gevonden zijn en met welk zekerheidsniveau, hoeveel e-mailadressen en telefoonnummers niet bruikbaar zijn. Het overzicht van elke opdracht geeft ze per categorie van uitkomst, en je account bewaart de geschiedenis van alles wat je hebt verwerkt.
Het cijfer dat echt telt komt daarna, en is van jou: hoeveel post er bij de volgende campagne terugkomt, en hoeveel dubbele mailings er de deur uit gaan. Als je dat vóór de correctie niet mat, is dit het moment om te beginnen: het is de enige manier om te weten wat het heeft opgeleverd.
Een record voor en na de correctie
jan.devries@gmial.com
jan.devries@gmail.com (typefout gecorrigeerd)
Elke rij van het resultaat draagt de uitkomst en de lijst van wijzigingen met de reden. Staat er in het bestand ook “De Vries J., Kalverstraat 92, 1012 PH AMSTERDAM”, dan koppelt het ontdubbelen dat record aan dit record met zijn zekerheidsniveau. Naam en e-mailadres zijn verzonnen voor demonstratiedoeleinden; elke verwijzing naar echte personen berust op toeval.
De vragen die volgen
Moet ik het bestand opschonen voordat ik het upload?
Nee. Het bestand upload je zoals het is: het herkennen van scheidingsteken, tekencodering en kolomkoppen hoort bij het werk. De kolommen mogen de namen hebben die jij gebruikt.
Kan ik maar een deel van de correctie doen, bijvoorbeeld alleen de dubbele records?
Ja. Elke stap is een opdracht op zich. Het ontdubbelen zet de adressen hoe dan ook recht vóór de vergelijking, omdat zonder die stap dubbele records die anders geschreven zijn niet herkend worden.
Worden de records in mijn eigen systeem gewijzigd?
Nee. RadarAddress werkt op het bestand dat je uploadt en geeft je een resultaatbestand terug met de juiste vorm naast de oorspronkelijke. Wat je in je systeem overneemt, bepaal je zelf.
Hoe groot mag het bestand zijn dat ik upload?
De adresverificatie werkt tot een miljoen rijen in één opdracht, het ontdubbelen tot honderdduizend records. Daarboven splits je het bestand.
En de contacten die niet recht te zetten zijn?
Die blijven in het resultaatbestand met de uitkomst die uitlegt waarom: straat niet gevonden in de gemeente, huisnummer ontbreekt, e-mailadres met een domein dat niet bestaat. Dat is de lijst van wat je met de hand bekijkt of aan de klant vraagt.
Hoe vaak moet het opnieuw?
Dat hangt af van hoeveel er het bestand binnenkomt. Wie externe lijsten importeert of veel handmatige invoer heeft, herhaalt het vóór elke campagne; wie weinig mutaties heeft, doet het één keer en verifieert daarna de nieuwe contacten vanuit het formulier of de API op het moment van invoer.
Bereid het bestand voor en upload het
De gids legt uit welke kolommen elke stap nodig heeft en hoe je het resultaatbestand leest.
Bereid het bestand voor en upload hetLees ook: De adressen in een Excel-bestand verifiëren · Dubbele records in een bestand vinden · Een e-maillijst opschonen