Entraîner un classificateur de texte
Plongez, regroupez et prédisez le sentiment.
Entraîner un classificateur de texte est une leçon Deep Learning Academy gratuite sur CoddyKit. Ceci est la leçon 4 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage Deep Learning Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours Deep Learning Academy comprend 4 leçons au total.
Certaines parties de cette leçon n'ont pas encore été traduites et s'affichent en anglais.
The Goal: Predict a Label
A text classifier reads a sentence and predicts a label, like positive or negative sentiment for a movie review. 🎬
Step One: Encode the Text
Reuse your pipeline: tokenize each review and map tokens to ids, turning every sentence into a list of integers.
Step Two: Embed the Ids
Feed those ids into an embedding layer. Each review becomes a sequence of dense word vectors the model can process.
self.emb = nn.Embedding(vocab_size, 32)Step Three: Pool the Vectors
A sentence has many vectors but you need one. Pooling, often a mean over the words, collapses them into a single vector.
pooled = vecs.mean(dim=1) # average over the sequenceStep Four: A Linear Head
Send the pooled vector through a linear layer to produce one score per class. These raw scores are called logits.
self.fc = nn.Linear(32, num_classes)Assemble the Model
Stack embed, pool, and the linear head in a forward method. That is a complete, tiny text classifier.
def forward(self, ids):
x = self.emb(ids).mean(dim=1)
return self.fc(x)Pick the Loss
For multiclass labels use cross-entropy loss. It expects raw logits and the integer class index as the target.
loss_fn = nn.CrossEntropyLoss()Choose an Optimizer
An optimizer like Adam updates the embedding and linear weights together as it minimizes the loss.
opt = torch.optim.Adam(model.parameters(), lr=1e-3)The Training Loop
For each batch: forward, compute loss, backward, and step. Repeat over the data for several epochs.
logits = model(ids)
loss = loss_fn(logits, labels)
loss.backward()
opt.step()Make a Prediction
At inference, take the class with the highest logit using argmax to get the predicted label for new text.
pred = model(ids).argmax(dim=1)Measure Accuracy
Compare predictions to true labels to compute accuracy. Watch it climb as the embedding learns sentiment patterns.
Quick Check
In this classifier, what turns a sequence of word vectors into one vector?
Recap
You embed ids, pool them into one vector, classify with a linear head, and train with cross-entropy to label text. ✅
Questions Fréquemment Posées
La leçon « Entraîner un classificateur de texte » est-elle gratuite ?
Oui — le texte complet de « Entraîner un classificateur de texte » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours Deep Learning Academy, passe à CoddyKit PRO. Le cours Deep Learning Academy comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « Entraîner un classificateur de texte » ?
Plongez, regroupez et prédisez le sentiment. Tu pratiques Deep Learning Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer Deep Learning Academy ?
Aucune expérience préalable n'est requise. Deep Learning Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 4 sur 4.
Combien de temps prend la leçon « Entraîner un classificateur de texte » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon Deep Learning Academy ?
Oui. Chaque leçon Deep Learning Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- Tokeniser et construire un vocabulaire
- nn.Embedding : vecteurs de mots apprenables
- Pourquoi les plongements capturent le sens
- Entraîner un classificateur de texte