NLP Academy · Leçon

À l’intérieur du bloc Transformer

Comment l’architecture complète s’assemble

Leçon 4 sur 413 étapes

À l’intérieur du bloc Transformer est une leçon NLP Academy gratuite sur CoddyKit. Ceci est la leçon 4 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage NLP Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours NLP Academy comprend 4 leçons au total.

Empiler les blocs

Un transformeur est construit en empilant plusieurs fois le même bloc. Chaque bloc affine un peu plus la représentation. 🧱

Deux sous-couches principales

Chaque bloc comporte deux parties : une sous-couche d’attention multi-tête, suivie d’un petit réseau à propagation avant appliqué à chaque position.

Le réseau à propagation avant

La sous-couche à propagation avant se compose de deux couches linéaires séparées par une non-linéarité. Elle traite chaque unité indépendamment pour accroître la puissance du modèle.

h = relu(x @ W1 + b1) @ W2 + b2

Connexions résiduelles

Chaque sous-couche enveloppe son entrée dans une connexion résiduelle : ajoutez l’entrée à la sortie afin de laisser circuler les gradients et de ne rien perdre.

out = x + sublayer(x)

Normalisation de couche

Après l’ajout du résidu, la normalisation de couche remet les valeurs à l’échelle. Les activations restent ainsi stables et l’entraînement est accéléré.

out = layer_norm(x + sublayer(x))

Blocs encodeurs

Un empilement d’encodeurs lit l’entrée et construit des vecteurs de contexte riches. Il utilise l’auto-attention afin que chaque unité voie toutes les autres.

Blocs décodeurs

Un décodeur génère la sortie une unité à la fois. Il ajoute une attention masquée ainsi qu’une attention croisée vers l’encodeur.

Attention masquée

Lors de la génération, le masquage dissimule les unités futures afin que le décodeur ne puisse pas regarder à l’avance et doive prédire honnêtement le mot suivant.

Attention croisée

L’attention croisée permet au décodeur d’interroger les sorties de l’encodeur, reliant ce qu’il écrit à ce qu’il a lu à l’origine.

La profondeur apporte de la puissance

L’empilement de nombreux blocs permet aux premières couches de repérer des schémas simples et aux couches suivantes de construire un sens abstrait, comme dans les réseaux profonds de vision.

Encodeur, décodeur ou les deux

BERT utilise uniquement l’encodeur, GPT uniquement le décodeur, et les modèles de traduction utilisent les deux. Le bloc est l’unité de construction commune. 🚀

Vérification rapide

Vérifions la structure du bloc.

Récapitulatif

Vous avez assemblé le bloc du transformeur : attention et propagation avant, entourées de connexions résiduelles et d’une normalisation de couche, puis empilées dans des encodeurs et des décodeurs. ✨

Gratuit pour commencer

Apprends Python avec un tuteur IA — gratuit

Écris et exécute du vrai code dans ton navigateur, obtiens de l'aide instantanée d'un tuteur IA disponible 24h/24, et reprends là où tu t'es arrêté sur le web ou dans l'app.

Cours
30
Leçons
120

Questions Fréquemment Posées

La leçon « À l’intérieur du bloc Transformer » est-elle gratuite ?

Oui — le texte complet de « À l’intérieur du bloc Transformer » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours NLP Academy, passe à CoddyKit PRO. Le cours NLP Academy comprend 4 leçons au total.

Qu'est-ce que j'apprendrai dans « À l’intérieur du bloc Transformer » ?

Comment l’architecture complète s’assemble Tu pratiques NLP Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.

Dois-je avoir de l'expérience pour commencer NLP Academy ?

Aucune expérience préalable n'est requise. NLP Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 4 sur 4.

Combien de temps prend la leçon « À l’intérieur du bloc Transformer » ?

La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.

Peux-tu écrire et exécuter du code dans cette leçon NLP Academy ?

Oui. Chaque leçon NLP Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.

Toutes les leçons de ce cours

  1. L’idée de l’attention
  2. L’auto-attention, étape par étape
  3. Attention multi-têtes et positions
  4. À l’intérieur du bloc Transformer
← Retour à NLP Academy