0Pricing
Linux Command Line & Bash Scripting Mastery · Lezione

Ordinamento e deduplicazione dei dati (sort, uniq, cut)

Trasformi il testo grezzo in dati puliti e ordinati. Impari a ordinare le righe, rimuovere i duplicati con uniq ed estrarre le colonne con cut, per poi concatenarli nelle pipeline.

Ordinamento e deduplicazione dei dati (sort, uniq, cut) è una lezione Linux Command Line & Bash Scripting Mastery gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento Linux Command Line & Bash Scripting Mastery, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso Linux Command Line & Bash Scripting Mastery include 4 lezioni in totale.

Dare forma ai dati testuali

I file di log e i CSV sono semplicemente righe di testo. Tre strumenti classici consentono di elaborarli: sort ordina le righe, uniq rimuove i duplicati e cut estrae le colonne.

Ordinamento di base

sort ordina le righe alfabeticamente per impostazione predefinita e stampa il risultato.

sort names.txt

Ordinamento numerico

Il sort semplice tratta i numeri come testo (10 prima di 2). Utilizzare -n per un vero ordinamento numerico e -r per invertirlo.

sort -n sizes.txt
sort -nr sizes.txt   # largest first

Ordinamento per campo

Utilizzare -k per ordinare in base a una colonna specifica e -t per impostare il delimitatore.

sort -t: -k3 -n /etc/passwd   # by UID

Rimozione dei duplicati con uniq

uniq raggruppa le righe duplicate adiacenti. Funziona solo su input ordinato, quindi viene quasi sempre usato insieme a sort.

sort access.log | uniq

Contare le occorrenze

uniq -c antepone a ogni riga il numero di volte in cui è comparsa: è perfetto per l'analisi delle frequenze.

sort ips.txt | uniq -c

Trovare gli elementi più frequenti

Combinare sort, uniq -c e un altro sort per classificare gli elementi in base alla frequenza: un report "top N" in una sola riga.

sort ips.txt | uniq -c | sort -nr | head -5

Estrarre colonne con cut

cut estrae i campi da ogni riga. Utilizzare -d per il delimitatore e -f per i numeri dei campi.

cut -d, -f1,3 data.csv   # 1st and 3rd columns

Tagliare per carattere

cut -c estrae intervalli di caratteri in base alla posizione, utile per dati a larghezza fissa.

cut -c1-8 dates.txt   # first 8 chars

Righe univoche e duplicate

uniq -d mostra solo le righe ripetute, mentre uniq -u mostra solo quelle che compaiono esattamente una volta.

sort orders.txt | uniq -d   # repeated only

Creare una pipeline

La vera potenza sta nel concatenare i comandi: estrarre una colonna, ordinarla e poi contare i valori univoci per riepilogare un dataset con un solo comando.

cut -d, -f2 sales.csv | sort | uniq -c | sort -nr

Verifica rapida

Verifichi la Sua comprensione.

Riepilogo

Ha imparato a elaborare i dati con sort (alfabetico, numerico -n, per campo -k), uniq (rimozione delle righe adiacenti duplicate, conteggio con -c, -d/-u) e cut (campi con -d/-f, caratteri con -c), concatenati in potenti pipeline.

Domande Frequenti

La lezione «Ordinamento e deduplicazione dei dati (sort, uniq, cut)» è gratuita?

Sì — il testo completo di «Ordinamento e deduplicazione dei dati (sort, uniq, cut)» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso Linux Command Line & Bash Scripting Mastery, passa a CoddyKit PRO. Il corso Linux Command Line & Bash Scripting Mastery include 4 lezioni in totale.

Cosa imparerò in «Ordinamento e deduplicazione dei dati (sort, uniq, cut)»?

Trasformi il testo grezzo in dati puliti e ordinati. Impari a ordinare le righe, rimuovere i duplicati con uniq ed estrarre le colonne con cut, per poi concatenarli nelle pipeline. Eserciti Linux Command Line & Bash Scripting Mastery con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.

Ho bisogno di esperienza per iniziare Linux Command Line & Bash Scripting Mastery?

Non è richiesta alcuna esperienza precedente. Linux Command Line & Bash Scripting Mastery su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.

Quanto tempo richiede la lezione «Ordinamento e deduplicazione dei dati (sort, uniq, cut)»?

La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.

Posso scrivere ed eseguire codice in questa lezione Linux Command Line & Bash Scripting Mastery?

Sì. Ogni lezione Linux Command Line & Bash Scripting Mastery include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.

Tutte le lezioni di questo corso

  1. Manipolazione avanzata del testo (sed, awk)
  2. Archiviazione e compressione (tar, gzip, unzip)
  3. Utilizzo del disco e informazioni di sistema (df, du, uname)
  4. Ordinamento e deduplicazione dei dati (sort, uniq, cut)
← Torna a Linux Command Line & Bash Scripting Mastery