L’auto-attention, étape par étape
Requêtes, clés et valeurs
L’auto-attention, étape par étape est une leçon NLP Academy gratuite sur CoddyKit. Ceci est la leçon 2 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage NLP Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours NLP Academy comprend 4 leçons au total.
Qu’est-ce que l’auto-attention ?
Avec l’auto-attention, chaque mot examine tous les autres mots de la même phrase afin de construire une version de lui-même plus riche et tenant compte du contexte. 🔍
Trois rôles par mot
Chaque mot est projeté dans trois vecteurs : une requête, une clé et une valeur. Ces trois rôles pilotent tout le calcul de l’auto-attention.
La requête
La requête représente ce que recherche un mot. Considérez-la comme la question que ce mot pose à propos du reste de la phrase.
Clés et valeurs
Chaque mot fournit également une clé qui indique ce qu’il contient, ainsi qu’une valeur contenant les informations à transmettre s’il est sélectionné.
Évaluer avec des produits scalaires
Comparez une requête à chaque clé à l’aide d’un produit scalaire. Un produit élevé signifie que la requête et la clé sont bien alignées : ce mot mérite donc davantage d’attention.
scores = query @ keys.TMettre les scores à l’échelle
Divisez les scores par la racine carrée de la dimension des clés. Cette mise à l’échelle stabilise les nombres afin que softmax ne devienne pas trop sélectif.
scores = scores / (d_k ** 0.5)Softmax pour obtenir les poids
Faites passer les scores mis à l’échelle dans softmax pour obtenir des poids d’attention positifs dont la somme vaut 1 sur l’ensemble des mots de la phrase.
weights = softmax(scores)Combiner les valeurs
Multipliez chaque valeur par son poids, puis additionnez-les. Vous obtenez ainsi un nouveau vecteur qui combine les informations des mots les plus pertinents.
output = weights @ valuesLa formule complète
Toutes les étapes se réunissent dans une expression claire : l’attention à produit scalaire mis à l’échelle appliquée aux requêtes, aux clés et aux valeurs, comme elle a été présentée dans l’article sur le transformeur.
attn = softmax(Q @ K.T / d_k**0.5) @ VPourquoi « auto » et non « croisée » ?
On parle d’auto-attention parce que les requêtes, les clés et les valeurs proviennent toutes de la même séquence ; les mots peuvent ainsi se concentrer sur leurs propres voisins.
Résoudre l’ambiguïté
Dans « it was tired », l’auto-attention relie it au nom correct en pondérant les mots voisins, ce qui fournit un contexte plus clair à chaque unité.
Vérification rapide
Vérifions les étapes de l’auto-attention.
Récapitulatif
Vous avez parcouru l’auto-attention : transformer les mots en requêtes, clés et valeurs, évaluer, mettre à l’échelle, appliquer softmax, puis combiner les valeurs. Voilà le moteur. ⚙️
Apprends Python avec un tuteur IA — gratuit
Écris et exécute du vrai code dans ton navigateur, obtiens de l'aide instantanée d'un tuteur IA disponible 24h/24, et reprends là où tu t'es arrêté sur le web ou dans l'app.
- Cours
- 30
- Leçons
- 120
Questions Fréquemment Posées
La leçon « L’auto-attention, étape par étape » est-elle gratuite ?
Oui — le texte complet de « L’auto-attention, étape par étape » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours NLP Academy, passe à CoddyKit PRO. Le cours NLP Academy comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « L’auto-attention, étape par étape » ?
Requêtes, clés et valeurs Tu pratiques NLP Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer NLP Academy ?
Aucune expérience préalable n'est requise. NLP Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 2 sur 4.
Combien de temps prend la leçon « L’auto-attention, étape par étape » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon NLP Academy ?
Oui. Chaque leçon NLP Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- L’idée de l’attention
- L’auto-attention, étape par étape
- Attention multi-têtes et positions
- À l’intérieur du bloc Transformer