NLP Academy · Pelajaran

Self-Attention, Langkah demi Langkah

Query, key, dan value

Pelajaran 2 dari 413 langkah

Self-Attention, Langkah demi Langkah adalah pelajaran NLP Academy gratis di CoddyKit. Ini adalah pelajaran 2 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar NLP Academy, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus NLP Academy mencakup 4 pelajaran total.

Apa Itu Atensi Diri?

Dalam atensi-diri, setiap kata melihat semua kata lain dalam kalimat yang sama untuk membangun versi dirinya yang lebih kaya dan sadar konteks. 🔍

Tiga Peran untuk Setiap Kata

Setiap kata diproyeksikan menjadi tiga vektor: kueri, kunci, dan nilai. Ketiga peran ini menggerakkan seluruh perhitungan atensi-diri.

Kueri

Kueri mewakili hal yang sedang dicari oleh sebuah kata. Anggaplah ini sebagai pertanyaan yang diajukan kata tersebut tentang bagian kalimat lainnya.

Kunci dan Nilai

Setiap kata juga menyediakan kunci yang menunjukkan apa yang dikandungnya, serta nilai yang menyimpan informasi sebenarnya untuk diteruskan jika dipilih.

Menilai dengan Hasil Kali Titik

Bandingkan kueri dengan setiap kunci menggunakan hasil kali titik. Hasil kali yang lebih besar berarti kueri dan kunci lebih selaras, sehingga kata tersebut layak mendapat lebih banyak fokus.

scores = query @ keys.T

Menskalakan Nilai

Bagilah nilai dengan akar kuadrat dari dimensi kunci. Penskalaan ini menjaga angka tetap stabil agar softmax tidak menjadi terlalu tajam.

scores = scores / (d_k ** 0.5)

Softmax untuk Bobot

Jalankan nilai yang telah diskalakan melalui softmax untuk mendapatkan bobot atensi yang positif dan jumlahnya 1 di seluruh kata dalam kalimat.

weights = softmax(scores)

Memadukan Nilai

Kalikan setiap nilai dengan bobotnya, lalu jumlahkan semuanya. Hasilnya adalah vektor baru yang memadukan informasi dari kata-kata paling relevan.

output = weights @ values

Rumus Lengkap

Semua langkah berpadu menjadi satu ekspresi yang rapi: atensi hasil kali titik yang diskalakan atas kueri, kunci, dan nilai, sebagaimana diperkenalkan dalam makalah Transformer.

attn = softmax(Q @ K.T / d_k**0.5) @ V

Mengapa Diri, Bukan Silang

Disebut atensi diri karena kueri, kunci, dan nilainya semuanya berasal dari urutan yang sama, sehingga kata-kata dapat memperhatikan tetangganya sendiri.

Menyelesaikan Ambiguitas

Dalam "it was tired," atensi-diri menghubungkan it dengan kata benda yang tepat melalui pembobotan kata-kata di dekatnya, sehingga setiap token memperoleh konteks yang lebih jelas.

Pemeriksaan Singkat

Mari kita memastikan langkah-langkah atensi-diri.

Rangkuman

Anda telah menelusuri atensi-diri: mengubah kata menjadi kueri, kunci, dan nilai, memberi nilai, melakukan penskalaan, menjalankan softmax, lalu memadukan nilainya. Itulah mesinnya. ⚙️

Gratis untuk memulai

Belajar Python dengan tutor AI — gratis

Tulis dan jalankan kode asli di browser kamu, dapatkan bantuan instan dari tutor AI 24/7, dan lanjutkan di mana kamu tinggalkan di web atau aplikasi.

Kursus
30
Pelajaran
120

Pertanyaan yang Sering Diajukan

Apakah pelajaran “Self-Attention, Langkah demi Langkah” gratis?

Ya — teks lengkap “Self-Attention, Langkah demi Langkah” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus NLP Academy, upgrade ke CoddyKit PRO. Kursus NLP Academy mencakup 4 pelajaran total.

Apa yang akan aku pelajari di “Self-Attention, Langkah demi Langkah”?

Query, key, dan value Kamu berlatih NLP Academy dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.

Apakah aku perlu pengalaman untuk memulai NLP Academy?

Tidak diperlukan pengalaman sebelumnya. NLP Academy di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 2 dari 4.

Berapa lama pelajaran “Self-Attention, Langkah demi Langkah” memakan waktu?

Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.

Bisakah aku menulis dan menjalankan kode dalam pelajaran NLP Academy ini?

Ya. Setiap pelajaran NLP Academy menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.

Semua pelajaran dalam kursus ini

  1. Gagasan tentang Attention
  2. Self-Attention, Langkah demi Langkah
  3. Attention Multi-Head dan Posisi
  4. Bagian Dalam Blok Transformer
← Kembali ke NLP Academy