Un tableau contient souvent plus d’informations que nécessaire pour une tâche précise. Plutôt que de modifier manuellement des centaines de lignes, on peut agir sur deux axes : sélectionner les enregistrements utiles et réduire les colonnes au bon schéma.
Filtrer agit sur les lignes
Filtrer un CSV conserve les lignes correspondant à une condition. Avant le filtre, vérifiez la colonne choisie et le type de comparaison : le texte "10" et le nombre 10 peuvent être traités différemment selon l’opération.
Trier ne filtre rien
Trier un CSV change l’ordre des lignes sans en supprimer. Il faut distinguer tri textuel et tri numérique : en ordre alphabétique, 100 peut apparaître avant 20, alors qu’un tri numérique place naturellement 20 avant 100.
Sélectionner les colonnes utiles
Sélectionner les colonnes CSV réduit le tableau sans toucher aux lignes. Cette opération limite aussi la diffusion de données inutiles : si un destinataire n’a besoin que d’un identifiant et d’un statut, les autres colonnes n’ont pas à voyager avec le fichier.
Renommer pour harmoniser
Deux sources peuvent utiliser customer_id et client_id pour la même notion. Renommer les colonnes CSV harmonise les en-têtes avant une fusion ou une jointure.
Renommer une colonne ne change cependant pas son contenu. Si les valeurs utilisent des conventions différentes, une normalisation supplémentaire reste nécessaire.
Le Workspace couvre maintenant ces enchaînements
Le modèle Filtrer et trier un tableau enchaîne import, filtre des lignes, tri et export.
Pour préparer un fichier destiné à un autre système, Préparer un CSV combine sélection des colonnes, renommage et tri avant export.
Pour une diffusion externe, Préparer un tableau à partager ajoute une logique de formatage après sélection et renommage des colonnes.
Ces recettes évitent de reconstruire manuellement la même chaîne lorsque le besoin revient régulièrement.
Dans quel ordre effectuer les opérations ?
Si le fichier est très volumineux et que seule une petite partie des lignes est utile, filtrer tôt réduit le volume à traiter. Si la destination impose un schéma précis, sélectionner et renommer les colonnes avant l’export rend le résultat plus lisible.
Une chaîne courante peut être :
source
→ nettoyer
→ filtrer les lignes
→ sélectionner les colonnes
→ renommer les en-têtes
→ trier
→ exporter
L’ordre n’est pas universel. Il doit suivre le résultat attendu.
Réduire tôt simplifie le reste du traitement
Si un fichier contient cinquante colonnes mais que cinq seulement sont utiles, les sélectionner en début de traitement rend les opérations suivantes plus lisibles. De même, filtrer les lignes hors périmètre avant une fusion ou une comparaison évite de transporter des données inutiles.
Vérifier l’en-tête final
Après plusieurs transformations, relisez la première ligne et quelques enregistrements. Assurez-vous que chaque valeur se trouve toujours sous le bon en-tête et que les colonnes obligatoires n’ont pas été supprimées.
À retenir
Filtrer réduit les lignes, sélectionner réduit les colonnes, renommer stabilise le schéma et trier organise les enregistrements. Ces opérations simples sont maintenant disponibles dans plusieurs modèles Workspace, ce qui permet de passer facilement d’une correction ponctuelle à une préparation reproductible.