NLP Academy · 강의

ROUGE와 BLEU로 생성 결과 평가하기

요약과 번역의 품질을 측정합니다

레슨 4/413개 단계

ROUGE와 BLEU로 생성 결과 평가하기은(는) CoddyKit의 무료 NLP Academy 강의입니다. 이것은 4개 중 4번째 강의입니다. 아래에서 전체 강의를 무료로 읽을 수 있으며, 내장 코드 에디터와 24/7 AI 튜터와 함께 브라우저에서 직접 실습할 수 있습니다. 이 강의는 NLP Academy 학습 경로의 일부이며, 진행 상황이 웹과 CoddyKit 앱에 동기화됩니다. NLP Academy 강의에는 총 4개의 강의가 포함되어 있습니다.

생성 결과를 평가하는 이유

요약과 번역은 자유롭게 생성되는 텍스트이므로 하나의 정답만 있는 것이 아닙니다. 출력을 기준 텍스트와 비교하려면 평가지표가 필요합니다. 📏

기준 텍스트와 비교하기

ROUGE와 BLEU는 모두 생성된 텍스트를 하나 이상의 사람이 작성한 기준 텍스트와 비교합니다. 기준 텍스트와 더 많이 겹칠수록 점수가 높아집니다.

번역을 위한 BLEU

BLEU는 출력에 있는 짧은 단어 시퀀스 중 기준 텍스트에도 나타나는 것이 얼마나 많은지 측정합니다. 기계 번역의 대표적인 평가지표입니다.

BLEU는 정밀도를 중시합니다

BLEU는 정밀도에 초점을 둡니다. 즉, 출력의 어느 정도가 기준 텍스트와 일치하는지 확인합니다. 지나치게 짧은 텍스트로 모델이 유리해지는 것을 막기 위해 짧은 출력에 불이익을 줍니다.

요약을 위한 ROUGE

ROUGE는 요약에 널리 사용되는 평가지표입니다. 요약이 기준 텍스트의 내용을 얼마나 복원했는지 확인합니다.

ROUGE는 재현율을 중시합니다

ROUGE는 재현율에 중점을 둡니다. 요약이 기준 텍스트의 중요한 단어를 포착했는지 확인하는 것입니다. ROUGE-1은 단일 단어의 겹침을 셉니다.

ROUGE-L과 시퀀스

ROUGE-L은 가장 길게 일치하는 단어 시퀀스를 살펴봅니다. 단어만 같은 것이 아니라 기준 텍스트의 순서를 유지하는 출력을 더 높게 평가합니다.

ROUGE 계산하기

evaluate 라이브러리를 사용하면 평가 점수를 한 줄로 계산할 수 있습니다. rouge를 불러오고 예측 결과와 기준 텍스트를 전달하세요.

import evaluate
rouge = evaluate.load("rouge")
print(rouge.compute(predictions=preds, references=refs))

BLEU 계산하기

BLEU도 같은 방식으로 작동합니다. 여러 번역이 모두 올바를 수 있으므로 각 예측에는 기준 텍스트의 목록이 필요하다는 점에 유의하세요.

bleu = evaluate.load("bleu")
print(bleu.compute(predictions=preds, references=refs))

높을수록 좋습니다

두 점수 모두 겹치는 정도가 높을수록 상승합니다. 모델을 비교하는 데 유용하지만, 단일 절대 숫자만으로는 의미가 거의 없습니다.

평가지표는 의미를 놓칩니다

이러한 평가지표는 진정한 의미가 아니라 단어의 겹침을 셉니다. 다른 단어를 사용한 완벽한 바꿔 쓰기도 점수가 낮을 수 있으므로 사람의 검토와 함께 사용하세요.

빠른 확인

재현율을 중시하며 요약에 표준적으로 사용되는 평가지표는 무엇일까요?

정리

생성된 텍스트를 평가하는 방법을 배웠습니다. 번역의 정밀도에는 BLEU, 요약의 재현율에는 ROUGE를 사용하며, 두 지표 모두 사람의 판단이 여전히 필요한 이유도 알아보았습니다. 🎯

무료로 시작

AI 튜터와 함께 Python을(를) 배우세요 — 무료

브라우저에서 실제 코드를 작성하고 실행하며, 24/7 AI 튜터로부터 즉각적인 도움을 받고, 웹이나 앱에서 중단한 부분부터 계속 학습하세요.

코스
30
레슨
120

자주 묻는 질문

“ROUGE와 BLEU로 생성 결과 평가하기” 강의는 무료인가요?

네 — “ROUGE와 BLEU로 생성 결과 평가하기” 전체 내용을 이 웹사이트에서 무료로 읽을 수 있습니다. 인터랙티브하게 실습하려면(내장 코드 에디터와 24/7 AI 튜터), CoddyKit PRO로 업그레이드하면 NLP Academy 강의 전체를 잠금 해제할 수 있습니다. NLP Academy 강의에는 총 4개의 강의가 포함되어 있습니다.

“ROUGE와 BLEU로 생성 결과 평가하기”에서 뭘 배우나요?

요약과 번역의 품질을 측정합니다 브라우저에서 직접 실행하는 실습 코드로 NLP Academy을(를) 배우며, 24/7 AI 튜터가 강의를 진행하면서 질문에 답변해줍니다.

NLP Academy을(를) 시작하는 데 경험이 필요한가요?

사전 경험은 필요하지 않습니다. CoddyKit의 NLP Academy은(는) 초급자부터 고급 학습자까지를 위해 구성되어 있으므로, 여기서 시작하거나 처음부터 시작할 수 있으며 자신의 속도대로 진행할 수 있습니다. 이것은 4개 중 4번째 강의입니다.

“ROUGE와 BLEU로 생성 결과 평가하기” 강의는 얼마나 걸리나요?

대부분의 CoddyKit 강의는 약 5~10분이 소요됩니다. 각 강의는 간결하고 인터랙티브하여 꾸준한 진행이 가능하며, 웹과 앱에서 중단한 부분부터 바로 시작할 수 있습니다.

이 NLP Academy 강의에서 코드를 작성하고 실행할 수 있나요?

네. 모든 NLP Academy 강의에는 내장 코드 에디터가 포함되어 있으므로, 브라우저에서 바로 실제 코드를 작성하고 실행한 후 즉시 AI 피드백을 받을 수 있습니다 — 로컬 설정이 필요 없습니다.

이 강의의 모든 강의

  1. 추출형 요약과 추상적 요약 비교
  2. Seq2Seq 모델로 요약하기
  3. 실전 기계 번역
  4. ROUGE와 BLEU로 생성 결과 평가하기
← NLP Academy(으)로 돌아가기