Memuat Model dan Memproses Dokumen
Menjalankan teks melalui nlp() dalam satu pemanggilan
Memuat Model dan Memproses Dokumen adalah pelajaran NLP Academy gratis di CoddyKit. Ini adalah pelajaran 2 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar NLP Academy, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus NLP Academy mencakup 4 pelajaran total.
Pasang Terlebih Dahulu
Sebelum memuat apa pun, Anda perlu mengunduh model sekali. Model en_core_web_sm berukuran kecil, cepat, dan sempurna untuk memulai.
python -m spacy download en_core_web_smMuat Model
Anda mengaktifkan spaCy dengan spacy.load. Perintah ini membaca model dari disk dan memberikan objek nlp yang siap memproses teks.
import spacy
nlp = spacy.load("en_core_web_sm")Apa Itu nlp
Objek nlp tersebut merupakan seluruh pipeline yang dibungkus menjadi satu. Memanggilnya pada teks menjalankan setiap tahap: tokenizer, pemberi label, pengurai, dan pengenal entitas.
Proses Teks
Untuk menganalisis sebuah kalimat, cukup panggil nlp() pada sebuah string. Hasilnya adalah sebuah Doc, wadah kaya yang menyimpan seluruh analisis.
doc = nlp("Apple is hiring in Berlin.")Satu Pemanggilan Menangani Semuanya
Pemanggilan tunggal tersebut sudah menjalankan tokenisasi, pemberian label, dan penguraian. Doc kini menyimpan semua hasilnya, sehingga Anda tidak perlu mengulangi pekerjaan tersebut.
Ulangi Token
Doc berperilaku seperti sebuah urutan, sehingga Anda dapat mengulanginya. Setiap item yang dikembalikan adalah sebuah Token dengan atributnya sendiri.
for token in doc:
print(token.text)Baca Teks Token
Kata mentah tersimpan di token.text. Nilainya sama persis dengan string permukaan yang ditemukan spaCy saat memisahkan kalimat Anda.
Muat Sekali, Gunakan Kembali
Memuat model membutuhkan waktu, jadi lakukan sekali saat aplikasi dimulai. Setelah itu, gunakan kembali objek nlp yang sama untuk setiap dokumen yang Anda proses.
Proses Banyak Dokumen
Untuk banyak teks, gunakan nlp.pipe. Fitur ini mengelompokkan teks secara efisien dan jauh lebih cepat daripada memanggil nlp() dalam perulangan biasa.
for doc in nlp.pipe(texts):
print(len(doc))Nonaktifkan demi Kecepatan
Hanya membutuhkan token? Anda dapat menonaktifkan komponen yang tidak digunakan saat memuat model agar pekerjaan yang tidak perlu dilewati dan proses berjalan lebih cepat.
nlp = spacy.load("en_core_web_sm", disable=["parser"])Pipeline Kosong
Anda juga dapat memulai dari spacy.blank untuk membuat pipeline yang hanya memiliki tokenizer. Ini berguna jika Anda ingin membangun semuanya sendiri.
nlp = spacy.blank("en")Pemeriksaan Singkat
Apa yang Anda dapatkan saat memanggil nlp() pada sebuah string?
Ringkasan
Anda memasang model, memuatnya sekali dengan spacy.load, lalu memanggil nlp() untuk mendapatkan sebuah Doc. Satu pemanggilan menjalankan seluruh pipeline dan dapat digunakan kembali di mana saja. 🎯
Belajar Python dengan tutor AI — gratis
Tulis dan jalankan kode asli di browser kamu, dapatkan bantuan instan dari tutor AI 24/7, dan lanjutkan di mana kamu tinggalkan di web atau aplikasi.
- Kursus
- 30
- Pelajaran
- 120
Pertanyaan yang Sering Diajukan
Apakah pelajaran “Memuat Model dan Memproses Dokumen” gratis?
Ya — teks lengkap “Memuat Model dan Memproses Dokumen” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus NLP Academy, upgrade ke CoddyKit PRO. Kursus NLP Academy mencakup 4 pelajaran total.
Apa yang akan aku pelajari di “Memuat Model dan Memproses Dokumen”?
Menjalankan teks melalui nlp() dalam satu pemanggilan Kamu berlatih NLP Academy dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.
Apakah aku perlu pengalaman untuk memulai NLP Academy?
Tidak diperlukan pengalaman sebelumnya. NLP Academy di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 2 dari 4.
Berapa lama pelajaran “Memuat Model dan Memproses Dokumen” memakan waktu?
Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.
Bisakah aku menulis dan menjalankan kode dalam pelajaran NLP Academy ini?
Ya. Setiap pelajaran NLP Academy menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.
Semua pelajaran dalam kursus ini
- Mengapa spaCy untuk Proyek Nyata
- Memuat Model dan Memproses Dokumen
- Token, Span, dan Objek Doc
- Menyesuaikan Alur Pemrosesan