0Pricing
Learn Rust Coding · Lezione

UTF-8 e char

Gestione di Unicode

UTF-8 e char è una lezione Learn Rust Coding gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento Learn Rust Coding, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso Learn Rust Coding include 4 lezioni in totale.

Le stringhe di Rust sono UTF-8

Ogni String e &str di Rust è codificata in UTF-8. Ciò significa che il testo può contenere qualsiasi carattere Unicode, non solo ASCII.

fn main() {
    let s = String::from("caf\u{e9}");
    println!("{}", s);
}

Che cos'è UTF-8?

UTF-8 codifica ogni carattere Unicode usando da uno a quattro byte. I caratteri ASCII usano un solo byte; le lettere accentate e le emoji ne usano di più.

fn main() {
    let ascii = "A";          // 1 byte
    let accent = "\u{e9}";    // 2 bytes (e-acute)
    println!("{} bytes vs {} bytes", ascii.len(), accent.len());
}

Byte e caratteri

A causa della codifica a più byte, len() restituisce i byte, mentre il numero di caratteri può essere inferiore.

fn main() {
    let s = "caf\u{e9}";
    println!("bytes {}", s.len());
    println!("chars {}", s.chars().count());
}

Il tipo char è Unicode

Un char di Rust è un valore di 4 byte che può contenere qualsiasi valore scalare Unicode, ben oltre un singolo byte.

fn main() {
    let letter = 'Z';
    let accented = '\u{f1}'; // n with tilde
    println!("{} {}", letter, accented);
}

Iterare sui caratteri

Usi chars() per scorrere il testo carattere per carattere. Gestisce correttamente i caratteri composti da più byte.

fn main() {
    let s = "a\u{e9}z";
    for c in s.chars() {
        println!("{}", c);
    }
}

Perché non può indicizzare per numero

Rust non consente di usare s[0] su una stringa. Poiché i caratteri possono avere dimensioni diverse in byte, indicizzare con un singolo numero sarebbe ambiguo e non sicuro.

fn main() {
    let s = "hello";
    // let c = s[0]; // error: cannot index a str
    let first = s.chars().next().unwrap();
    println!("{}", first);
}

Ottenere l'ennesimo carattere

Usi il metodo dell'iteratore nth per ottenere un carattere in base alla posizione. Restituisce un Option.

fn main() {
    let s = "abcdef";
    let third = s.chars().nth(2);
    println!("{:?}", third);
}

Iterare sui byte

Quando ha davvero bisogno dei byte grezzi, usi bytes(), che restituisce valori u8.

fn main() {
    let s = "AB";
    for b in s.bytes() {
        println!("{}", b);
    }
}

Creare slice sui confini dei byte

Le slice di stringa usano indici di byte. La slice deve iniziare e terminare su un confine di carattere valido, altrimenti il programma va in panic.

fn main() {
    let s = "hello";
    let part = &s[0..3]; // valid ASCII boundary
    println!("{}", part);
}

Metodi di char

Il tipo char dispone di metodi utili come is_alphabetic, is_numeric e to_uppercase.

fn main() {
    let c = 'k';
    println!("alpha {} numeric {}", c.is_alphabetic(), c.is_numeric());
    println!("upper {}", c.to_uppercase());
}

Contare caratteri specifici

Combini chars con filter per contare i caratteri che soddisfano una condizione.

fn main() {
    let s = "banana";
    let a_count = s.chars().filter(|&c| c == 'a').count();
    println!("a appears {} times", a_count);
}

Verifica rapida

Ricordi perché la lunghezza di una stringa può riservare sorprese.

Riepilogo

UTF-8 e char in Rust:

  • Le stringhe sono UTF-8; i caratteri occupano da 1 a 4 byte.
  • len() restituisce i byte; chars().count() restituisce i caratteri.
  • Non può indicizzare una stringa per numero; usi chars() o nth.
  • Le slice devono trovarsi sui confini dei caratteri.
fn main() {
    let s = "sm\u{ee}le";
    println!("bytes {} chars {}", s.len(), s.chars().count());
    for c in s.chars() {
        print!("{} ", c);
    }
    println!();
}

Domande Frequenti

La lezione «UTF-8 e char» è gratuita?

Sì — il testo completo di «UTF-8 e char» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso Learn Rust Coding, passa a CoddyKit PRO. Il corso Learn Rust Coding include 4 lezioni in totale.

Cosa imparerò in «UTF-8 e char»?

Gestione di Unicode Eserciti Learn Rust Coding con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.

Ho bisogno di esperienza per iniziare Learn Rust Coding?

Non è richiesta alcuna esperienza precedente. Learn Rust Coding su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.

Quanto tempo richiede la lezione «UTF-8 e char»?

La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.

Posso scrivere ed eseguire codice in questa lezione Learn Rust Coding?

Sì. Ogni lezione Learn Rust Coding include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.

Tutte le lezioni di questo corso

  1. String vs &str
  2. Slice
  3. Metodi delle stringhe
  4. UTF-8 e char
← Torna a Learn Rust Coding