DataGuide

Importer un CSV client : les zéros initiaux et les accents révèlent les vrais pièges

Retrouvez DigiTechLab dans vos sources préférées.

Illustration : Contrôle d’un tableur client sur un ordinateur portable

Un export client peut sembler propre dans le logiciel qui l’a produit et devenir inutilisable après ouverture dans un tableur. Une référence perd ses premiers zéros, une date change de sens et un nom accentué se transforme en suite de caractères. Le fichier existe toujours, mais sa lecture a modifié l’interprétation des données. Avant de confier un import à une agence, un intégrateur ou un outil SaaS, l’entreprise doit vérifier quelques cas représentatifs et définir ce que chaque colonne signifie réellement.

En bref : le séparateur, l’encodage et le type de chaque champ doivent être contrôlés avant l’import ; un affichage correct ne prouve pas que la valeur a été conservée.

Une référence peut ressembler à un nombre sans en être un

Un identifiant comme 00127 désigne une fiche, pas une quantité à additionner. Si le tableur l’interprète comme un nombre, il peut supprimer les zéros initiaux. Le même problème concerne des codes postaux et des références longues. L’import doit préciser les colonnes à traiter comme du texte. La décision dépend du rôle du champ, plutôt que de son apparence. Ajouter un format d’affichage après conversion ne permet pas toujours de retrouver la valeur d’origine.

Le test doit conserver le fichier original et examiner la valeur exportée après manipulation. Une cellule qui affiche cinq chiffres peut contenir un nombre auquel un format ajoute seulement des zéros. Cette différence devient visible lors d’un nouvel export vers un autre système. Le responsable doit choisir quelques identifiants difficiles, puis vérifier leur conservation d’un bout à l’autre du circuit. Le résultat attendu est la même référence exploitable, pas seulement une colonne visuellement alignée.

Décrire les conventions du fichier avant de l’ouvrir

Un CSV contient des champs séparés selon une convention, avec des règles pour les valeurs qui contiennent elles-mêmes un séparateur ou un retour à la ligne. Le nom de l’extension ne précise pas toutes ces règles. Il faut identifier le séparateur, l’encodage et la manière dont les champs sont délimités. L’ouverture automatique peut choisir une interprétation qui convient au poste, mais pas au fichier reçu. Un assistant d’import permet de contrôler ces choix avant de modifier les données.

Les nombres et les dates méritent une vérification distincte. Une virgule peut jouer le rôle de séparateur décimal ou de séparation entre champs selon le format. Une date courte peut être interprétée dans plusieurs ordres. Le document de préparation doit donner un exemple non ambigu pour chaque type. Il faut également préciser la signification d’une cellule vide : donnée inconnue, absence volontaire ou valeur à effacer. Ces situations peuvent produire des actions différentes dans le logiciel de destination.

Tester les cas difficiles sur un petit lot

L’échantillon doit contenir des accents, des guillemets, des champs vides, des retours à la ligne et des identifiants particuliers. Il doit aussi inclure les catégories métier qui utilisent des formats différents. Un lot composé uniquement de noms simples et de données complètes valide peu de choses. L’intégrateur doit montrer le résultat obtenu dans le système cible, avec les champs concernés et les éventuels messages de rejet. Le test doit utiliser des données appropriées, en limitant les informations personnelles nécessaires.

Le nombre de lignes importées ne suffit pas à établir la qualité du transfert. Il faut regarder les valeurs, les rapprochements et les dossiers rejetés. Un contact peut être créé sous une nouvelle identité au lieu de mettre à jour sa fiche existante. La règle de reconnaissance doit être définie avant le chargement complet. Une référence stable apporte un repère plus fiable qu’un rapprochement improvisé sur le seul nom, qui peut varier ou être partagé par plusieurs personnes.

Avant de fermer un compte, le même contrôle de conservation s’applique à les vérifications d’un export Google Takeout.

Prévoir la correction et le contrôle final

Le dispositif doit conserver un journal utilisable des erreurs, sans y exposer inutilement toutes les données clients. Chaque rejet doit pouvoir être rapproché d’une ligne source et d’une raison compréhensible. Le responsable doit savoir si une correction permet de reprendre uniquement les dossiers concernés ou nécessite un nouvel import complet. Cette différence influence le temps de traitement et le risque de doublon. Elle doit apparaître dans la démonstration de l’outil ou dans la méthode du prestataire.

Après le chargement, la vérification doit rapprocher quelques dossiers complets, les volumes attendus et les anomalies déjà identifiées. Le fichier original, les paramètres et le compte rendu doivent être conservés dans un espace maîtrisé. Un prochain import pourra alors reprendre une méthode documentée plutôt qu’une succession de corrections manuelles. Le CSV devient un format d’échange contrôlé, avec des conventions explicites, au lieu d’un document que chaque utilisateur ouvre selon les réglages de son propre poste.

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *