Ordinamento e deduplicazione dei dati (sort, uniq, cut)
Trasformi il testo grezzo in dati puliti e ordinati. Impari a ordinare le righe, rimuovere i duplicati con uniq ed estrarre le colonne con cut, per poi concatenarli nelle pipeline.
Ordinamento e deduplicazione dei dati (sort, uniq, cut) è una lezione DevOps Bootcamp gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento DevOps Bootcamp, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso DevOps Bootcamp include 4 lezioni in totale.
Dare forma ai dati testuali
I file di log e i CSV sono semplicemente righe di testo. Tre strumenti classici consentono di elaborarli: sort ordina le righe, uniq rimuove i duplicati e cut estrae le colonne.
Ordinamento di base
sort ordina le righe alfabeticamente per impostazione predefinita e stampa il risultato.
sort names.txtOrdinamento numerico
Il sort semplice tratta i numeri come testo (10 prima di 2). Utilizzare -n per un vero ordinamento numerico e -r per invertirlo.
sort -n sizes.txt
sort -nr sizes.txt # largest firstOrdinamento per campo
Utilizzare -k per ordinare in base a una colonna specifica e -t per impostare il delimitatore.
sort -t: -k3 -n /etc/passwd # by UIDRimozione dei duplicati con uniq
uniq raggruppa le righe duplicate adiacenti. Funziona solo su input ordinato, quindi viene quasi sempre usato insieme a sort.
sort access.log | uniqContare le occorrenze
uniq -c antepone a ogni riga il numero di volte in cui è comparsa: è perfetto per l'analisi delle frequenze.
sort ips.txt | uniq -cTrovare gli elementi più frequenti
Combinare sort, uniq -c e un altro sort per classificare gli elementi in base alla frequenza: un report "top N" in una sola riga.
sort ips.txt | uniq -c | sort -nr | head -5Estrarre colonne con cut
cut estrae i campi da ogni riga. Utilizzare -d per il delimitatore e -f per i numeri dei campi.
cut -d, -f1,3 data.csv # 1st and 3rd columnsTagliare per carattere
cut -c estrae intervalli di caratteri in base alla posizione, utile per dati a larghezza fissa.
cut -c1-8 dates.txt # first 8 charsRighe univoche e duplicate
uniq -d mostra solo le righe ripetute, mentre uniq -u mostra solo quelle che compaiono esattamente una volta.
sort orders.txt | uniq -d # repeated onlyCreare una pipeline
La vera potenza sta nel concatenare i comandi: estrarre una colonna, ordinarla e poi contare i valori univoci per riepilogare un dataset con un solo comando.
cut -d, -f2 sales.csv | sort | uniq -c | sort -nrVerifica rapida
Verifichi la Sua comprensione.
Riepilogo
Ha imparato a elaborare i dati con sort (alfabetico, numerico -n, per campo -k), uniq (rimozione delle righe adiacenti duplicate, conteggio con -c, -d/-u) e cut (campi con -d/-f, caratteri con -c), concatenati in potenti pipeline.
Impara DevOps Bootcamp con un tutor IA — gratis
Scrivi ed esegui vero codice nel tuo browser, ricevi aiuto istantaneo da un tutor IA disponibile 24/7, e riprendi da dove hai lasciato sul web o nell'app.
- Corsi
- 142
- Lezioni
- 568
Domande Frequenti
La lezione «Ordinamento e deduplicazione dei dati (sort, uniq, cut)» è gratuita?
Sì — il testo completo di «Ordinamento e deduplicazione dei dati (sort, uniq, cut)» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso DevOps Bootcamp, passa a CoddyKit PRO. Il corso DevOps Bootcamp include 4 lezioni in totale.
Cosa imparerò in «Ordinamento e deduplicazione dei dati (sort, uniq, cut)»?
Trasformi il testo grezzo in dati puliti e ordinati. Impari a ordinare le righe, rimuovere i duplicati con uniq ed estrarre le colonne con cut, per poi concatenarli nelle pipeline. Eserciti DevOps Bootcamp con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.
Ho bisogno di esperienza per iniziare DevOps Bootcamp?
Non è richiesta alcuna esperienza precedente. DevOps Bootcamp su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.
Quanto tempo richiede la lezione «Ordinamento e deduplicazione dei dati (sort, uniq, cut)»?
La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.
Posso scrivere ed eseguire codice in questa lezione DevOps Bootcamp?
Sì. Ogni lezione DevOps Bootcamp include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.
Tutte le lezioni di questo corso
- Manipolazione avanzata del testo (sed, awk)
- Archiviazione e compressione (tar, gzip, unzip)
- Utilizzo del disco e informazioni di sistema (df, du, uname)
- Ordinamento e deduplicazione dei dati (sort, uniq, cut)