Ordinamento e deduplicazione dei dati (sort, uniq, cut)
Trasformi il testo grezzo in dati puliti e ordinati. Impari a ordinare le righe, rimuovere i duplicati con uniq ed estrarre le colonne con cut, per poi concatenarli nelle pipeline.
Ordinamento e deduplicazione dei dati (sort, uniq, cut) è una lezione Linux Command Line & Bash Scripting Mastery gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento Linux Command Line & Bash Scripting Mastery, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso Linux Command Line & Bash Scripting Mastery include 4 lezioni in totale.
Dare forma ai dati testuali
I file di log e i CSV sono semplicemente righe di testo. Tre strumenti classici consentono di elaborarli: sort ordina le righe, uniq rimuove i duplicati e cut estrae le colonne.
Ordinamento di base
sort ordina le righe alfabeticamente per impostazione predefinita e stampa il risultato.
sort names.txtOrdinamento numerico
Il sort semplice tratta i numeri come testo (10 prima di 2). Utilizzare -n per un vero ordinamento numerico e -r per invertirlo.
sort -n sizes.txt
sort -nr sizes.txt # largest firstOrdinamento per campo
Utilizzare -k per ordinare in base a una colonna specifica e -t per impostare il delimitatore.
sort -t: -k3 -n /etc/passwd # by UIDRimozione dei duplicati con uniq
uniq raggruppa le righe duplicate adiacenti. Funziona solo su input ordinato, quindi viene quasi sempre usato insieme a sort.
sort access.log | uniqContare le occorrenze
uniq -c antepone a ogni riga il numero di volte in cui è comparsa: è perfetto per l'analisi delle frequenze.
sort ips.txt | uniq -cTrovare gli elementi più frequenti
Combinare sort, uniq -c e un altro sort per classificare gli elementi in base alla frequenza: un report "top N" in una sola riga.
sort ips.txt | uniq -c | sort -nr | head -5Estrarre colonne con cut
cut estrae i campi da ogni riga. Utilizzare -d per il delimitatore e -f per i numeri dei campi.
cut -d, -f1,3 data.csv # 1st and 3rd columnsTagliare per carattere
cut -c estrae intervalli di caratteri in base alla posizione, utile per dati a larghezza fissa.
cut -c1-8 dates.txt # first 8 charsRighe univoche e duplicate
uniq -d mostra solo le righe ripetute, mentre uniq -u mostra solo quelle che compaiono esattamente una volta.
sort orders.txt | uniq -d # repeated onlyCreare una pipeline
La vera potenza sta nel concatenare i comandi: estrarre una colonna, ordinarla e poi contare i valori univoci per riepilogare un dataset con un solo comando.
cut -d, -f2 sales.csv | sort | uniq -c | sort -nrVerifica rapida
Verifichi la Sua comprensione.
Riepilogo
Ha imparato a elaborare i dati con sort (alfabetico, numerico -n, per campo -k), uniq (rimozione delle righe adiacenti duplicate, conteggio con -c, -d/-u) e cut (campi con -d/-f, caratteri con -c), concatenati in potenti pipeline.
Domande Frequenti
La lezione «Ordinamento e deduplicazione dei dati (sort, uniq, cut)» è gratuita?
Sì — il testo completo di «Ordinamento e deduplicazione dei dati (sort, uniq, cut)» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso Linux Command Line & Bash Scripting Mastery, passa a CoddyKit PRO. Il corso Linux Command Line & Bash Scripting Mastery include 4 lezioni in totale.
Cosa imparerò in «Ordinamento e deduplicazione dei dati (sort, uniq, cut)»?
Trasformi il testo grezzo in dati puliti e ordinati. Impari a ordinare le righe, rimuovere i duplicati con uniq ed estrarre le colonne con cut, per poi concatenarli nelle pipeline. Eserciti Linux Command Line & Bash Scripting Mastery con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.
Ho bisogno di esperienza per iniziare Linux Command Line & Bash Scripting Mastery?
Non è richiesta alcuna esperienza precedente. Linux Command Line & Bash Scripting Mastery su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.
Quanto tempo richiede la lezione «Ordinamento e deduplicazione dei dati (sort, uniq, cut)»?
La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.
Posso scrivere ed eseguire codice in questa lezione Linux Command Line & Bash Scripting Mastery?
Sì. Ogni lezione Linux Command Line & Bash Scripting Mastery include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.
Tutte le lezioni di questo corso
- Manipolazione avanzata del testo (sed, awk)
- Archiviazione e compressione (tar, gzip, unzip)
- Utilizzo del disco e informazioni di sistema (df, du, uname)
- Ordinamento e deduplicazione dei dati (sort, uniq, cut)