NLP Academy · Pelajaran

Memuat Model dan Memproses Dokumen

Menjalankan teks melalui nlp() dalam satu pemanggilan

Pelajaran 2 dari 413 langkah

Memuat Model dan Memproses Dokumen adalah pelajaran NLP Academy gratis di CoddyKit. Ini adalah pelajaran 2 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar NLP Academy, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus NLP Academy mencakup 4 pelajaran total.

Pasang Terlebih Dahulu

Sebelum memuat apa pun, Anda perlu mengunduh model sekali. Model en_core_web_sm berukuran kecil, cepat, dan sempurna untuk memulai.

python -m spacy download en_core_web_sm

Muat Model

Anda mengaktifkan spaCy dengan spacy.load. Perintah ini membaca model dari disk dan memberikan objek nlp yang siap memproses teks.

import spacy
nlp = spacy.load("en_core_web_sm")

Apa Itu nlp

Objek nlp tersebut merupakan seluruh pipeline yang dibungkus menjadi satu. Memanggilnya pada teks menjalankan setiap tahap: tokenizer, pemberi label, pengurai, dan pengenal entitas.

Proses Teks

Untuk menganalisis sebuah kalimat, cukup panggil nlp() pada sebuah string. Hasilnya adalah sebuah Doc, wadah kaya yang menyimpan seluruh analisis.

doc = nlp("Apple is hiring in Berlin.")

Satu Pemanggilan Menangani Semuanya

Pemanggilan tunggal tersebut sudah menjalankan tokenisasi, pemberian label, dan penguraian. Doc kini menyimpan semua hasilnya, sehingga Anda tidak perlu mengulangi pekerjaan tersebut.

Ulangi Token

Doc berperilaku seperti sebuah urutan, sehingga Anda dapat mengulanginya. Setiap item yang dikembalikan adalah sebuah Token dengan atributnya sendiri.

for token in doc:
    print(token.text)

Baca Teks Token

Kata mentah tersimpan di token.text. Nilainya sama persis dengan string permukaan yang ditemukan spaCy saat memisahkan kalimat Anda.

Muat Sekali, Gunakan Kembali

Memuat model membutuhkan waktu, jadi lakukan sekali saat aplikasi dimulai. Setelah itu, gunakan kembali objek nlp yang sama untuk setiap dokumen yang Anda proses.

Proses Banyak Dokumen

Untuk banyak teks, gunakan nlp.pipe. Fitur ini mengelompokkan teks secara efisien dan jauh lebih cepat daripada memanggil nlp() dalam perulangan biasa.

for doc in nlp.pipe(texts):
    print(len(doc))

Nonaktifkan demi Kecepatan

Hanya membutuhkan token? Anda dapat menonaktifkan komponen yang tidak digunakan saat memuat model agar pekerjaan yang tidak perlu dilewati dan proses berjalan lebih cepat.

nlp = spacy.load("en_core_web_sm", disable=["parser"])

Pipeline Kosong

Anda juga dapat memulai dari spacy.blank untuk membuat pipeline yang hanya memiliki tokenizer. Ini berguna jika Anda ingin membangun semuanya sendiri.

nlp = spacy.blank("en")

Pemeriksaan Singkat

Apa yang Anda dapatkan saat memanggil nlp() pada sebuah string?

Ringkasan

Anda memasang model, memuatnya sekali dengan spacy.load, lalu memanggil nlp() untuk mendapatkan sebuah Doc. Satu pemanggilan menjalankan seluruh pipeline dan dapat digunakan kembali di mana saja. 🎯

Gratis untuk memulai

Belajar Python dengan tutor AI — gratis

Tulis dan jalankan kode asli di browser kamu, dapatkan bantuan instan dari tutor AI 24/7, dan lanjutkan di mana kamu tinggalkan di web atau aplikasi.

Kursus
30
Pelajaran
120

Pertanyaan yang Sering Diajukan

Apakah pelajaran “Memuat Model dan Memproses Dokumen” gratis?

Ya — teks lengkap “Memuat Model dan Memproses Dokumen” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus NLP Academy, upgrade ke CoddyKit PRO. Kursus NLP Academy mencakup 4 pelajaran total.

Apa yang akan aku pelajari di “Memuat Model dan Memproses Dokumen”?

Menjalankan teks melalui nlp() dalam satu pemanggilan Kamu berlatih NLP Academy dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.

Apakah aku perlu pengalaman untuk memulai NLP Academy?

Tidak diperlukan pengalaman sebelumnya. NLP Academy di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 2 dari 4.

Berapa lama pelajaran “Memuat Model dan Memproses Dokumen” memakan waktu?

Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.

Bisakah aku menulis dan menjalankan kode dalam pelajaran NLP Academy ini?

Ya. Setiap pelajaran NLP Academy menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.

Semua pelajaran dalam kursus ini

  1. Mengapa spaCy untuk Proyek Nyata
  2. Memuat Model dan Memproses Dokumen
  3. Token, Span, dan Objek Doc
  4. Menyesuaikan Alur Pemrosesan
← Kembali ke NLP Academy