Menilai Generasi dengan ROUGE dan BLEU
Mengukur kualitas ringkasan dan terjemahan
Menilai Generasi dengan ROUGE dan BLEU adalah pelajaran NLP Academy gratis di CoddyKit. Ini adalah pelajaran 4 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar NLP Academy, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus NLP Academy mencakup 4 pelajaran total.
Mengapa Menilai Hasil Generasi?
Ringkasan dan terjemahan merupakan teks bebas, sehingga tidak ada satu jawaban yang benar. Kita memerlukan metrik untuk membandingkan keluaran dengan teks acuan. 📏
Bandingkan dengan Acuan
ROUGE dan BLEU sama-sama membandingkan teks yang Anda hasilkan dengan satu atau beberapa acuan buatan manusia. Semakin banyak kemiripan dengan acuan, semakin tinggi nilainya.
BLEU untuk Terjemahan
BLEU mengukur berapa banyak rangkaian kata pendek dalam keluaran Anda yang juga muncul dalam acuan. Ini merupakan metrik klasik untuk terjemahan mesin.
BLEU Menghargai Ketepatan
BLEU berfokus pada ketepatan: metrik ini menanyakan seberapa banyak keluaran Anda yang cocok dengan acuan. Penalti singkat mencegah model berbuat curang dengan menghasilkan teks yang sangat pendek.
ROUGE untuk Ringkasan
ROUGE merupakan metrik utama untuk peringkasan. Metrik ini memeriksa seberapa banyak isi acuan yang berhasil dipulihkan oleh ringkasan Anda.
ROUGE Menghargai Cakupan
ROUGE mengandalkan cakupan: apakah ringkasan Anda menangkap kata-kata penting dari acuan? ROUGE-1 menghitung kemiripan kata tunggal.
ROUGE-L dan Rangkaian
ROUGE-L melihat rangkaian kata yang paling panjang dan cocok, serta menghargai keluaran yang mempertahankan urutan acuan, bukan hanya kata-katanya.
Menghitung ROUGE
Pustaka evaluate membuat penilaian dapat dilakukan dalam satu baris. Load rouge dan berikan prediksi beserta acuannya.
import evaluate
rouge = evaluate.load("rouge")
print(rouge.compute(predictions=preds, references=refs))Menghitung BLEU
BLEU bekerja dengan cara yang sama. Perhatikan bahwa setiap prediksi memerlukan daftar acuan karena beberapa terjemahan dapat sama-sama benar.
bleu = evaluate.load("bleu")
print(bleu.compute(predictions=preds, references=refs))Semakin Tinggi Semakin Baik
Kedua nilai meningkat seiring bertambahnya kemiripan. Keduanya berguna untuk membandingkan model, tetapi satu angka absolut tidak banyak berarti jika berdiri sendiri.
Metrik Tidak Menangkap Makna
Metrik ini menghitung kemiripan kata, bukan makna yang sebenarnya. Parafrasa sempurna dengan kata-kata berbeda tetap dapat memperoleh nilai rendah, jadi gunakan metrik ini bersama peninjauan manusia.
Pemeriksaan Singkat
Metrik mana yang berfokus pada cakupan dan menjadi standar untuk peringkasan?
Rangkuman
Anda belajar menilai teks yang dihasilkan: BLEU untuk ketepatan terjemahan, ROUGE untuk cakupan ringkasan, serta alasan keduanya tetap memerlukan penilaian manusia. 🎯
Belajar Python dengan tutor AI — gratis
Tulis dan jalankan kode asli di browser kamu, dapatkan bantuan instan dari tutor AI 24/7, dan lanjutkan di mana kamu tinggalkan di web atau aplikasi.
- Kursus
- 30
- Pelajaran
- 120
Pertanyaan yang Sering Diajukan
Apakah pelajaran “Menilai Generasi dengan ROUGE dan BLEU” gratis?
Ya — teks lengkap “Menilai Generasi dengan ROUGE dan BLEU” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus NLP Academy, upgrade ke CoddyKit PRO. Kursus NLP Academy mencakup 4 pelajaran total.
Apa yang akan aku pelajari di “Menilai Generasi dengan ROUGE dan BLEU”?
Mengukur kualitas ringkasan dan terjemahan Kamu berlatih NLP Academy dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.
Apakah aku perlu pengalaman untuk memulai NLP Academy?
Tidak diperlukan pengalaman sebelumnya. NLP Academy di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 4 dari 4.
Berapa lama pelajaran “Menilai Generasi dengan ROUGE dan BLEU” memakan waktu?
Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.
Bisakah aku menulis dan menjalankan kode dalam pelajaran NLP Academy ini?
Ya. Setiap pelajaran NLP Academy menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.
Semua pelajaran dalam kursus ini
- Ringkasan Ekstraktif vs Abstraktif
- Meringkas dengan Model Seq2Seq
- Penerjemahan Mesin dalam Praktik
- Menilai Generasi dengan ROUGE dan BLEU