NLP Academy · Leçon

L’auto-attention, étape par étape

Requêtes, clés et valeurs

Leçon 2 sur 413 étapes

L’auto-attention, étape par étape est une leçon NLP Academy gratuite sur CoddyKit. Ceci est la leçon 2 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage NLP Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours NLP Academy comprend 4 leçons au total.

Qu’est-ce que l’auto-attention ?

Avec l’auto-attention, chaque mot examine tous les autres mots de la même phrase afin de construire une version de lui-même plus riche et tenant compte du contexte. 🔍

Trois rôles par mot

Chaque mot est projeté dans trois vecteurs : une requête, une clé et une valeur. Ces trois rôles pilotent tout le calcul de l’auto-attention.

La requête

La requête représente ce que recherche un mot. Considérez-la comme la question que ce mot pose à propos du reste de la phrase.

Clés et valeurs

Chaque mot fournit également une clé qui indique ce qu’il contient, ainsi qu’une valeur contenant les informations à transmettre s’il est sélectionné.

Évaluer avec des produits scalaires

Comparez une requête à chaque clé à l’aide d’un produit scalaire. Un produit élevé signifie que la requête et la clé sont bien alignées : ce mot mérite donc davantage d’attention.

scores = query @ keys.T

Mettre les scores à l’échelle

Divisez les scores par la racine carrée de la dimension des clés. Cette mise à l’échelle stabilise les nombres afin que softmax ne devienne pas trop sélectif.

scores = scores / (d_k ** 0.5)

Softmax pour obtenir les poids

Faites passer les scores mis à l’échelle dans softmax pour obtenir des poids d’attention positifs dont la somme vaut 1 sur l’ensemble des mots de la phrase.

weights = softmax(scores)

Combiner les valeurs

Multipliez chaque valeur par son poids, puis additionnez-les. Vous obtenez ainsi un nouveau vecteur qui combine les informations des mots les plus pertinents.

output = weights @ values

La formule complète

Toutes les étapes se réunissent dans une expression claire : l’attention à produit scalaire mis à l’échelle appliquée aux requêtes, aux clés et aux valeurs, comme elle a été présentée dans l’article sur le transformeur.

attn = softmax(Q @ K.T / d_k**0.5) @ V

Pourquoi « auto » et non « croisée » ?

On parle d’auto-attention parce que les requêtes, les clés et les valeurs proviennent toutes de la même séquence ; les mots peuvent ainsi se concentrer sur leurs propres voisins.

Résoudre l’ambiguïté

Dans « it was tired », l’auto-attention relie it au nom correct en pondérant les mots voisins, ce qui fournit un contexte plus clair à chaque unité.

Vérification rapide

Vérifions les étapes de l’auto-attention.

Récapitulatif

Vous avez parcouru l’auto-attention : transformer les mots en requêtes, clés et valeurs, évaluer, mettre à l’échelle, appliquer softmax, puis combiner les valeurs. Voilà le moteur. ⚙️

Gratuit pour commencer

Apprends Python avec un tuteur IA — gratuit

Écris et exécute du vrai code dans ton navigateur, obtiens de l'aide instantanée d'un tuteur IA disponible 24h/24, et reprends là où tu t'es arrêté sur le web ou dans l'app.

Cours
30
Leçons
120

Questions Fréquemment Posées

La leçon « L’auto-attention, étape par étape » est-elle gratuite ?

Oui — le texte complet de « L’auto-attention, étape par étape » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours NLP Academy, passe à CoddyKit PRO. Le cours NLP Academy comprend 4 leçons au total.

Qu'est-ce que j'apprendrai dans « L’auto-attention, étape par étape » ?

Requêtes, clés et valeurs Tu pratiques NLP Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.

Dois-je avoir de l'expérience pour commencer NLP Academy ?

Aucune expérience préalable n'est requise. NLP Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 2 sur 4.

Combien de temps prend la leçon « L’auto-attention, étape par étape » ?

La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.

Peux-tu écrire et exécuter du code dans cette leçon NLP Academy ?

Oui. Chaque leçon NLP Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.

Toutes les leçons de ce cours

  1. L’idée de l’attention
  2. L’auto-attention, étape par étape
  3. Attention multi-têtes et positions
  4. À l’intérieur du bloc Transformer
← Retour à NLP Academy