Wyodrębnianie fraz według wzorca tagów
Wyodrębnij frazy rzeczownikowe i czasowniki
Wyodrębnianie fraz według wzorca tagów to bezpłatna lekcja NLP Academy na CoddyKit. To lekcja 3 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej NLP Academy, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs NLP Academy zawiera 4 lekcji w sumie.
Części tej lekcji nie zostały jeszcze przetłumaczone i są wyświetlane po angielsku.
From Tags to Phrases
Single tags are useful, but meaning often lives in groups of words. Tag patterns let you pull out whole phrases instead of lone tokens. 🧩
What Is a Noun Chunk?
A noun chunk is a noun plus the words describing it, like the fluffy cat. These chunks usually name the key things a sentence is about.
Get Noun Chunks Free
spaCy finds noun chunks for you. Iterate over doc.noun_chunks to grab each one as a span without writing any rules.
for chunk in doc.noun_chunks:
print(chunk.text)Chunks Are Spans
Each noun chunk is a Span, a slice of the Doc. A span knows its text, start, and end, so you can reuse it like any other token group.
chunk = list(doc.noun_chunks)[0]
print(chunk.start, chunk.end)Pull Out Every Verb
To collect actions, keep tokens whose pos_ is VERB. A list comprehension gathers them all in a single readable line.
verbs = [t.text for t in doc if t.pos_ == "VERB"]Match Custom Patterns
For your own rules, use the Matcher. You describe a sequence of token attributes, and spaCy finds every place that sequence appears.
from spacy.matcher import Matcher
matcher = Matcher(nlp.vocab)Define a Tag Sequence
A pattern is a list of dictionaries, one per token. This one matches an adjective followed by a noun, like fluffy cat.
pattern = [{"POS": "ADJ"}, {"POS": "NOUN"}]Add the Pattern
Register your pattern under a name with matcher.add(). The name lets you group related rules and identify matches later.
matcher.add("ADJ_NOUN", [pattern])Run the Matcher
Call the matcher on a Doc to get matches. Each result is a tuple of a match id plus the start and end token positions.
matches = matcher(doc)Read Each Match
Slice the Doc with the start and end to turn a match into readable text. That slice is the phrase your pattern captured.
for mid, start, end in matches:
print(doc[start:end].text)Patterns Beat Regex Here
Tag patterns understand grammar, so they catch phrases regex would miss. Matching on POS is far cleaner than chasing exact letters.
Quick Check
Think about how to extract grouped nouns.
Recap
You extracted phrases two ways: built-in noun_chunks and custom tag patterns with the Matcher. Now you can mine grammar, not just words. 🎉
Często zadawane pytania
Czy lekcja „Wyodrębnianie fraz według wzorca tagów” jest bezpłatna?
Tak — pełny tekst „Wyodrębnianie fraz według wzorca tagów” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu NLP Academy, przejdź na CoddyKit PRO. Kurs NLP Academy zawiera 4 lekcji w sumie.
Co nauczysz się w „Wyodrębnianie fraz według wzorca tagów”?
Wyodrębnij frazy rzeczownikowe i czasowniki Ćwiczysz NLP Academy z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.
Czy potrzebuję doświadczenia, aby zacząć NLP Academy?
Nie wymagamy żadnego doświadczenia. NLP Academy w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 3 z 4.
Ile czasu zajmuje lekcja „Wyodrębnianie fraz według wzorca tagów”?
Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.
Czy mogę pisać i uruchamiać kod w tej lekcji NLP Academy?
Tak. Każda lekcja NLP Academy zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.
Wszystkie lekcje w tym kursie
- Rzeczowniki, czasowniki i znaczenie tagów
- Tagowanie słów za pomocą spaCy
- Wyodrębnianie fraz według wzorca tagów
- Podstawy parsowania zależnościowego