Vai al contenuto principale
Bethemesh
GuidaBuone pratiche

Pulire un file CSV o Excel prima di utilizzarlo

Prepara una tabella eliminando duplicati, righe vuote e spazi inutili, controllando colonne e valori prima di importazione o analisi.

Pubblicato 29 agosto 2026Lettura : 3 minDi Team Bethemesh
Principiante
Mostra indice
  1. Conservare sempre il file originale
  2. Eliminare le righe davvero vuote
  3. Spazi superflui: piccoli difetti, grandi conseguenze
  4. Definire che cosa significa duplicato
  5. Non trasformare gli identificativi in numeri
  6. Controllare le intestazioni
  7. Controllare la struttura dopo la pulizia
  8. Pulizia e validazione sono complementari
  9. Normalizzare senza distruggere informazione
  10. Valori mancanti
  11. Un ordine di pulizia robusto

Prima di importare dati in un CRM, analizzarli o unirli ad altre fonti, è spesso utile pulire la tabella di partenza. L’obiettivo non è modificare i dati arbitrariamente, ma rimuovere difetti meccanici che compromettono i passaggi successivi.

Il Pulitore Excel e CSV riunisce diverse operazioni frequenti. Per esigenze più precise sono disponibili anche strumenti CSV dedicati.

Conservare sempre il file originale

Lavora su una copia. La pulizia può eliminare righe o modificare valori, quindi deve essere possibile confrontare il risultato con la sorgente, soprattutto quando il file contiene identificativi aziendali o deve essere reimportato in un altro sistema.

Eliminare le righe davvero vuote

Un foglio può contenere righe apparentemente vuote con celle formattate o caratteri invisibili. In un CSV, soli separatori possono creare record privi di informazione utile.

In un dataset queste righe generano rumore. In un documento pensato per la lettura umana, invece, uno spazio vuoto può essere intenzionale: va quindi distinto il dato dalla presentazione.

Spazi superflui: piccoli difetti, grandi conseguenze

Roma e Roma sembrano uguali, ma un confronto rigoroso può considerarli valori diversi. Gli spazi iniziali o finali possono causare duplicati non rilevati, gruppi separati, join falliti e filtri incompleti.

Normalizzarli prima di confronti e deduplicazione è una precauzione semplice e importante.

Definire che cosa significa duplicato

Due righe identiche sono facili da individuare. Due record cliente possono invece rappresentare la stessa persona con telefono o indirizzo differenti.

La domanda corretta è: quale colonna identifica davvero il record? Un ID cliente è spesso più affidabile del nome. Per una deduplicazione controllata usa Rimuovi duplicati CSV.

Non trasformare gli identificativi in numeri

00125 può essere un codice e non il numero 125. Una normalizzazione troppo aggressiva eliminerebbe gli zeri iniziali e cambierebbe il significato. Lo stesso vale per numeri di telefono, codici prodotto, pratiche e alcuni codici postali.

Prima di normalizzare una colonna, identifica la sua semantica, non solo l’aspetto.

Controllare le intestazioni

Nomi di colonna chiari semplificano tutte le operazioni successive. Evita colonne senza nome o intestazioni duplicate. Se serve soltanto correggere i nomi, Rinomina colonne CSV permette di farlo senza modificare il resto.

Controllare la struttura dopo la pulizia

Verifica numero di righe, intestazioni, alcuni record all’inizio e alla fine, colonne identificative e valori che devono conservare zeri o caratteri speciali.

Il Validatore CSV controlla la sintassi; Statistiche CSV offre una vista sintetica dei dati.

Pulizia e validazione sono complementari

Un CSV può essere sintatticamente valido ma contenere dati sbagliati. Al contrario, dati aziendali coerenti possono essere illeggibili se la sintassi del file è rotta.

La pulizia agisce soprattutto su righe e valori; la validazione sulla struttura del formato.

Normalizzare senza distruggere informazione

Uniformare IT, it e Italia può essere utile se la colonna rappresenta un paese. Convertire automaticamente tutti gli identificativi in numeri può invece distruggere informazioni.

La regola è: normalizza ciò di cui comprendi il significato. Per il resto, segnala l’anomalia prima di decidere.

Valori mancanti

Una cella vuota può significare dato sconosciuto, facoltativo o non applicabile. Prima di eliminare una riga o inserire un valore predefinito, chiediti se la colonna è obbligatoria, se il default ha senso e se l’assenza deve essere distinta da zero o stringa vuota.

Un ordine di pulizia robusto

  1. conserva la sorgente intatta;
  2. controlla intestazioni e separatore;
  3. elimina le righe davvero vuote;
  4. rimuovi spazi superflui;
  5. armonizza i nomi delle colonne;
  6. normalizza soltanto valori con regole note;
  7. gestisci i duplicati;
  8. valida la struttura finale;
  9. esporta nel formato richiesto.

Il livello di pulizia dipende sempre dal passaggio successivo. Per una fusione, armonizza soprattutto le colonne; per un confronto, stabilizza la chiave; per JSON, verifica le intestazioni che diventeranno proprietà.

Una buona pulizia non è un fine: prepara un’operazione precisa e rende il workflow riproducibile.

Strumenti correlati

Dati e fogli di calcolo

Pulisci un file Excel o CSV

Rimuovi duplicati, righe vuote e spazi inutili.

100% localeIn evidenza
Usa questo strumento
Dati e fogli di calcolo

Rimuovere i duplicati CSV

Rimuovi le righe duplicate di un file CSV in base alle colonne scelte.

100% locale
Usa questo strumento
Dati e fogli di calcolo

Validatore CSV

Valida la struttura di un file CSV e individua rapidamente righe o colonne problematiche.

100% locale
Usa questo strumento
Dati e fogli di calcolo

Statistiche CSV

Analizza le colonne di un CSV e ottieni rapidamente statistiche utili sui dati.

100% locale
Usa questo strumento

Raccolta

Padroneggiare dati e tabelle

  1. 01Dati e tabelle: capire CSV, Excel, JSON e la struttura di un dataset
  2. 02Pulire un file CSV o Excel prima di utilizzarlo
  3. 03Duplicati e validazione CSV: rendere affidabile una tabella prima dell'importazione
  4. 04Filtrare, ordinare e scegliere le colonne di un CSV senza romperne la struttura
  5. 05Unire più file CSV o Excel: allineare le colonne prima dell'assemblaggio
  6. 06Dividere un CSV o separare una tabella: scegliere il metodo giusto
  7. 07Confrontare due file CSV o Excel e individuare le differenze
  8. 08Convertire CSV, Excel, JSON e TSV senza perdere la struttura dei dati
  9. 09Costruire un workflow riproducibile di preparazione dei dati

Questo articolo ti è stato utile?