À l’intérieur du bloc Transformer
Comment l’architecture complète s’assemble
À l’intérieur du bloc Transformer est une leçon NLP Academy gratuite sur CoddyKit. Ceci est la leçon 4 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage NLP Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours NLP Academy comprend 4 leçons au total.
Empiler les blocs
Un transformeur est construit en empilant plusieurs fois le même bloc. Chaque bloc affine un peu plus la représentation. 🧱
Deux sous-couches principales
Chaque bloc comporte deux parties : une sous-couche d’attention multi-tête, suivie d’un petit réseau à propagation avant appliqué à chaque position.
Le réseau à propagation avant
La sous-couche à propagation avant se compose de deux couches linéaires séparées par une non-linéarité. Elle traite chaque unité indépendamment pour accroître la puissance du modèle.
h = relu(x @ W1 + b1) @ W2 + b2Connexions résiduelles
Chaque sous-couche enveloppe son entrée dans une connexion résiduelle : ajoutez l’entrée à la sortie afin de laisser circuler les gradients et de ne rien perdre.
out = x + sublayer(x)Normalisation de couche
Après l’ajout du résidu, la normalisation de couche remet les valeurs à l’échelle. Les activations restent ainsi stables et l’entraînement est accéléré.
out = layer_norm(x + sublayer(x))Blocs encodeurs
Un empilement d’encodeurs lit l’entrée et construit des vecteurs de contexte riches. Il utilise l’auto-attention afin que chaque unité voie toutes les autres.
Blocs décodeurs
Un décodeur génère la sortie une unité à la fois. Il ajoute une attention masquée ainsi qu’une attention croisée vers l’encodeur.
Attention masquée
Lors de la génération, le masquage dissimule les unités futures afin que le décodeur ne puisse pas regarder à l’avance et doive prédire honnêtement le mot suivant.
Attention croisée
L’attention croisée permet au décodeur d’interroger les sorties de l’encodeur, reliant ce qu’il écrit à ce qu’il a lu à l’origine.
La profondeur apporte de la puissance
L’empilement de nombreux blocs permet aux premières couches de repérer des schémas simples et aux couches suivantes de construire un sens abstrait, comme dans les réseaux profonds de vision.
Encodeur, décodeur ou les deux
BERT utilise uniquement l’encodeur, GPT uniquement le décodeur, et les modèles de traduction utilisent les deux. Le bloc est l’unité de construction commune. 🚀
Vérification rapide
Vérifions la structure du bloc.
Récapitulatif
Vous avez assemblé le bloc du transformeur : attention et propagation avant, entourées de connexions résiduelles et d’une normalisation de couche, puis empilées dans des encodeurs et des décodeurs. ✨
Apprends Python avec un tuteur IA — gratuit
Écris et exécute du vrai code dans ton navigateur, obtiens de l'aide instantanée d'un tuteur IA disponible 24h/24, et reprends là où tu t'es arrêté sur le web ou dans l'app.
- Cours
- 30
- Leçons
- 120
Questions Fréquemment Posées
La leçon « À l’intérieur du bloc Transformer » est-elle gratuite ?
Oui — le texte complet de « À l’intérieur du bloc Transformer » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours NLP Academy, passe à CoddyKit PRO. Le cours NLP Academy comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « À l’intérieur du bloc Transformer » ?
Comment l’architecture complète s’assemble Tu pratiques NLP Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer NLP Academy ?
Aucune expérience préalable n'est requise. NLP Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 4 sur 4.
Combien de temps prend la leçon « À l’intérieur du bloc Transformer » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon NLP Academy ?
Oui. Chaque leçon NLP Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- L’idée de l’attention
- L’auto-attention, étape par étape
- Attention multi-têtes et positions
- À l’intérieur du bloc Transformer