0Pricing
Excel Formulas Academy · Lekcja

Wyodrębnianie wzorców za pomocą REGEXEXTRACT

Wyodrębnianie z ciągu znaków fragmentu pasującego do wzorca

Wyodrębnianie wzorców za pomocą REGEXEXTRACT to bezpłatna lekcja Excel Formulas Academy na CoddyKit. To lekcja 2 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej Excel Formulas Academy, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs Excel Formulas Academy zawiera 4 lekcji w sumie.

Od tak/nie do pobierania dopasowanego fragmentu

REGEXMATCH informuje, czy wzorzec występuje. Często potrzebny jest sam dopasowany tekst, na przykład liczby z Order #4821 albo domena z adresu e-mail.

To zadanie funkcji REGEXEXTRACT. Znajduje ona pierwszy fragment tekstu pasujący do wzorca i zwraca ten fragment jako wartość komórki.

To kolejna funkcja Google Sheets. Jest jednym z najwygodniejszych sposobów wyodrębniania uporządkowanych fragmentów z nieuporządkowanych zaimportowanych danych.

Składnia REGEXEXTRACT

REGEXEXTRACT(text, pattern) zwraca pierwszy podciąg wartości text pasujący do wzorca pattern.

Jeśli nic nie zostanie dopasowane, funkcja zwraca błąd #N/A, a nie pustą wartość, o czym należy pamiętać.

Poniższa formuła pobiera pierwszy ciąg cyfr z A2. Dla wartości Order 4821 zwraca 4821.

=REGEXEXTRACT(A2, "\d+")

Zwraca tekst, nie liczbę

REGEXEXTRACT zawsze zwraca tekst, nawet gdy dopasowane znaki są cyframi. Dlatego 4821 jest zwracane jako ciąg tekstowy, a nie liczba, którą można sumować.

Aby przekształcić go w rzeczywistą liczbę, należy opakować go w funkcję VALUE. Poniższa formuła wyodrębnia cyfry i konwertuje je, aby można było wykonywać na wyniku obliczenia.

=VALUE(REGEXEXTRACT(A2, "\d+"))

Wyodrębnianie liter lub kodów

Wzorce nie ograniczają się do cyfr. Aby pobrać prefiks wielkich liter, należy użyć klasy z kwantyfikatorem.

Poniższa formuła pobiera początkowe litery z kodu takiego jak INV2024, zwracając INV. [A-Z]+ oznacza co najmniej jedną wielką literę występującą bezpośrednio po poprzedniej.

=REGEXEXTRACT(A2, "[A-Z]+")

Przykład: rozdzielanie kodu produktu

Załóżmy, że A2 zawiera SKU-4821-RED, a potrzebny jest tylko środkowy fragment numeryczny. Położenie można opisać, uwzględniając w wzorcu kontekst z obu stron.

Poniższa formuła wyszukuje cyfry znajdujące się między dwoma łącznikami i zwraca 4821. Dosłowne łączniki kierują silnik dopasowywania do właściwego ciągu cyfr.

=REGEXEXTRACT(A2, "-(\d+)-")

Grupy przechwytujące zwracają tylko potrzebny fragment

Proszę zwrócić uwagę na nawiasy w ostatniej formule: (\d+). To jest grupa przechwytująca.

Gdy wzorzec zawiera grupę przechwytującą, REGEXEXTRACT zwraca wyłącznie zawartość nawiasów, a nie całe dopasowanie. Dlatego -(\d+)- zwraca 4821 i pomija łączniki.

Grupy przechwytujące pozwalają dopasować otaczający kontekst w celu zwiększenia dokładności, a jednocześnie wyodrębnić tylko potrzebny fragment.

=REGEXEXTRACT(A2, "-(\d+)-")

Przykład: wyodrębnianie domeny e-mail

Z adresu sam@coddykit.com chcą Państwo wyodrębnić domenę coddykit.com. Należy dopasować znak @, a następnie przechwycić wszystko, co występuje po nim aż do końca.

Poniższa formuła zwraca fragment komórki A2 znajdujący się za znakiem „małpy”. Wyrażenie (.+) przechwytuje co najmniej jeden dowolny znak, a $ wiąże dopasowanie z końcem ciągu.

=REGEXEXTRACT(A2, "@(.+)$")

Kotwice zapewniają precyzyjne wyodrębnianie

Kotwice pomagają pobrać fragment z określonej pozycji. Aby przechwycić tylko pierwsze słowo, należy ustawić kotwicę na początku i zakończyć dopasowanie przy pierwszej spacji.

Poniższa formuła przechwytuje początkowe znaki komórki A2, które nie są spacjami. Dla John Smith zwraca John. Wyrażenie [^ ]+ oznacza co najmniej jeden znak, który nie jest spacją.

=REGEXEXTRACT(A2, "^([^ ]+)")

Obsługa braku dopasowania

Nieudane wyodrębnianie powoduje błąd #N/A, dlatego przeciągnięcie formuły w dół kolumny zawierającej różne dane może zaśmiecić arkusz błędami.

Należy opakować wywołanie w IFERROR, aby zapewnić przejrzystą wartość zastępczą. Poniższa formuła zwraca znalezione cyfry albo pusty ciąg, jeśli ich nie ma.

=IFERROR(REGEXEXTRACT(A2, "\d+"), "")

Wyodrębnianie z użyciem alternatywy

Pionowa kreska | oznacza lub. Pozwala jednemu wzorcowi dopasować kilka alternatyw. Jest to przydatne, gdy kod może zaczynać się od różnych prefiksów.

Poniższa formuła wyodrębnia dowolne słowo określające status występujące w A2: OPEN, CLOSED lub HOLD. Zwracane jest pierwsze znalezione słowo.

=REGEXEXTRACT(A2, "OPEN|CLOSED|HOLD")

Masowe wyodrębnianie z kolumny

REGEXEXTRACT doskonale sprawdza się przy stosowaniu do całej kolumny zaimportowanych danych. Z każdego wiersza pobierany jest pasujący fragment i umieszczany w nowej, uporządkowanej kolumnie, którą można sortować lub analizować.

Załóżmy, że kolumna A zawiera ciągi zamówień, takie jak Order 4821 - shipped. Poniższa formuła, przeciągnięta w dół kolumny B, wyodrębnia z każdego wiersza sam numer zamówienia, tworząc uporządkowaną kolumnę wyglądającą jak liczbowa, mimo nieuporządkowanego tekstu źródłowego.

=REGEXEXTRACT(A2, "Order (\d+)")

Szybki test

Sprawdźmy, co wiesz o wyodrębnianiu dopasowań.

Podsumowanie: wyodrębnianie dopasowanego fragmentu

Dowiedzieli się Państwo, że REGEXEXTRACT(text, pattern) zwraca pierwszy pasujący podciąg w Arkuszach Google. Najważniejsze informacje:

  • Wynik jest zawsze tekstem; w przypadku liczb należy użyć VALUE
  • Grupy przechwytujące w nawiasach zwracają tylko wewnętrzny fragment
  • Brak dopasowania daje #N/A, dlatego należy użyć IFERROR
  • | pozwala jednemu wzorcowi dopasować kilka alternatyw

W dalszej części wyjdą Państwo poza odczytywanie danych i zaczną przepisywać tekst bezpośrednio za pomocą REGEXREPLACE.

Często zadawane pytania

Czy lekcja „Wyodrębnianie wzorców za pomocą REGEXEXTRACT” jest bezpłatna?

Tak — pełny tekst „Wyodrębnianie wzorców za pomocą REGEXEXTRACT” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu Excel Formulas Academy, przejdź na CoddyKit PRO. Kurs Excel Formulas Academy zawiera 4 lekcji w sumie.

Co nauczysz się w „Wyodrębnianie wzorców za pomocą REGEXEXTRACT”?

Wyodrębnianie z ciągu znaków fragmentu pasującego do wzorca Ćwiczysz Excel Formulas Academy z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.

Czy potrzebuję doświadczenia, aby zacząć Excel Formulas Academy?

Nie wymagamy żadnego doświadczenia. Excel Formulas Academy w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 2 z 4.

Ile czasu zajmuje lekcja „Wyodrębnianie wzorców za pomocą REGEXEXTRACT”?

Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.

Czy mogę pisać i uruchamiać kod w tej lekcji Excel Formulas Academy?

Tak. Każda lekcja Excel Formulas Academy zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.

Wszystkie lekcje w tym kursie

  1. Testowanie wzorców za pomocą REGEXMATCH
  2. Wyodrębnianie wzorców za pomocą REGEXEXTRACT
  3. Zastępowanie wzorców za pomocą REGEXREPLACE
  4. Dzielenie i porządkowanie nieuporządkowanych danych
← Powrót do Excel Formulas Academy