DevOps Bootcamp · Lezione

Ordinamento e deduplicazione dei dati (sort, uniq, cut)

Trasformi il testo grezzo in dati puliti e ordinati. Impari a ordinare le righe, rimuovere i duplicati con uniq ed estrarre le colonne con cut, per poi concatenarli nelle pipeline.

Lezione 4 di 413 passaggi

Ordinamento e deduplicazione dei dati (sort, uniq, cut) è una lezione DevOps Bootcamp gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento DevOps Bootcamp, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso DevOps Bootcamp include 4 lezioni in totale.

Dare forma ai dati testuali

I file di log e i CSV sono semplicemente righe di testo. Tre strumenti classici consentono di elaborarli: sort ordina le righe, uniq rimuove i duplicati e cut estrae le colonne.

Ordinamento di base

sort ordina le righe alfabeticamente per impostazione predefinita e stampa il risultato.

sort names.txt

Ordinamento numerico

Il sort semplice tratta i numeri come testo (10 prima di 2). Utilizzare -n per un vero ordinamento numerico e -r per invertirlo.

sort -n sizes.txt
sort -nr sizes.txt   # largest first

Ordinamento per campo

Utilizzare -k per ordinare in base a una colonna specifica e -t per impostare il delimitatore.

sort -t: -k3 -n /etc/passwd   # by UID

Rimozione dei duplicati con uniq

uniq raggruppa le righe duplicate adiacenti. Funziona solo su input ordinato, quindi viene quasi sempre usato insieme a sort.

sort access.log | uniq

Contare le occorrenze

uniq -c antepone a ogni riga il numero di volte in cui è comparsa: è perfetto per l'analisi delle frequenze.

sort ips.txt | uniq -c

Trovare gli elementi più frequenti

Combinare sort, uniq -c e un altro sort per classificare gli elementi in base alla frequenza: un report "top N" in una sola riga.

sort ips.txt | uniq -c | sort -nr | head -5

Estrarre colonne con cut

cut estrae i campi da ogni riga. Utilizzare -d per il delimitatore e -f per i numeri dei campi.

cut -d, -f1,3 data.csv   # 1st and 3rd columns

Tagliare per carattere

cut -c estrae intervalli di caratteri in base alla posizione, utile per dati a larghezza fissa.

cut -c1-8 dates.txt   # first 8 chars

Righe univoche e duplicate

uniq -d mostra solo le righe ripetute, mentre uniq -u mostra solo quelle che compaiono esattamente una volta.

sort orders.txt | uniq -d   # repeated only

Creare una pipeline

La vera potenza sta nel concatenare i comandi: estrarre una colonna, ordinarla e poi contare i valori univoci per riepilogare un dataset con un solo comando.

cut -d, -f2 sales.csv | sort | uniq -c | sort -nr

Verifica rapida

Verifichi la Sua comprensione.

Riepilogo

Ha imparato a elaborare i dati con sort (alfabetico, numerico -n, per campo -k), uniq (rimozione delle righe adiacenti duplicate, conteggio con -c, -d/-u) e cut (campi con -d/-f, caratteri con -c), concatenati in potenti pipeline.

Gratis per iniziare

Impara DevOps Bootcamp con un tutor IA — gratis

Scrivi ed esegui vero codice nel tuo browser, ricevi aiuto istantaneo da un tutor IA disponibile 24/7, e riprendi da dove hai lasciato sul web o nell'app.

Corsi
142
Lezioni
568

Domande Frequenti

La lezione «Ordinamento e deduplicazione dei dati (sort, uniq, cut)» è gratuita?

Sì — il testo completo di «Ordinamento e deduplicazione dei dati (sort, uniq, cut)» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso DevOps Bootcamp, passa a CoddyKit PRO. Il corso DevOps Bootcamp include 4 lezioni in totale.

Cosa imparerò in «Ordinamento e deduplicazione dei dati (sort, uniq, cut)»?

Trasformi il testo grezzo in dati puliti e ordinati. Impari a ordinare le righe, rimuovere i duplicati con uniq ed estrarre le colonne con cut, per poi concatenarli nelle pipeline. Eserciti DevOps Bootcamp con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.

Ho bisogno di esperienza per iniziare DevOps Bootcamp?

Non è richiesta alcuna esperienza precedente. DevOps Bootcamp su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.

Quanto tempo richiede la lezione «Ordinamento e deduplicazione dei dati (sort, uniq, cut)»?

La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.

Posso scrivere ed eseguire codice in questa lezione DevOps Bootcamp?

Sì. Ogni lezione DevOps Bootcamp include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.

Tutte le lezioni di questo corso

  1. Manipolazione avanzata del testo (sed, awk)
  2. Archiviazione e compressione (tar, gzip, unzip)
  3. Utilizzo del disco e informazioni di sistema (df, du, uname)
  4. Ordinamento e deduplicazione dei dati (sort, uniq, cut)
← Torna a DevOps Bootcamp