0Pricing
R Academy · Lekcja

Korzystanie z REST API w R

Uwierzytelniaj się za pomocą kluczy API, stronicuj wyniki i zapisuj odpowiedzi API.

Korzystanie z REST API w R to bezpłatna lekcja R Academy na CoddyKit. To lekcja 3 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej R Academy, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs R Academy zawiera 4 lekcji w sumie.

Koncepcje REST API

Interfejsy REST API korzystają z metod HTTP (GET, POST, PUT, DELETE) stosowanych wobec adresów URL zasobów. Odpowiedzi są zazwyczaj zapisane w formacie JSON. Interfejsy API mogą wymagać uwierzytelniania, obsługiwać stronicowanie i nakładać ograniczenia częstotliwości. Dobry klient API w R radzi sobie ze wszystkimi trzema aspektami.

library(httr2)

# REST API anatomy:
# Base URL:  https://api.example.com/v1
# Resources: /users, /products, /orders
# Methods:
#   GET    /users       -> list users
#   POST   /users       -> create user
#   GET    /users/42    -> get user 42
#   PUT    /users/42    -> update user 42
#   DELETE /users/42    -> delete user 42

# Query parameters for filtering/pagination:
# GET /users?page=2&size=20&sort=name

cat('REST = stateless + resource-based + HTTP methods')

Uwierzytelnianie za pomocą tokenu Bearer

Większość nowoczesnych interfejsów API korzysta z tokenów Bearer (OAuth 2.0). Token należy przechowywać w zmiennej środowiskowej ustawionej za pomocą Sys.setenv() lub w pliku .Renviron. Nigdy nie umieszczaj tokenów na stałe w skryptach.

library(httr2)

# Store token securely in .Renviron:
# GITHUB_PAT=ghp_your_token_here

# Access at runtime:
token <- Sys.getenv('GITHUB_PAT')
if (nchar(token) == 0) token <- 'demo_token'

# Use in requests:
# resp <- request('https://api.github.com/user') |>
#   req_auth_bearer_token(token) |>
#   req_headers('Accept' = 'application/vnd.github.v3+json') |>
#   req_perform() |>
#   resp_check_status()

# result <- resp_body_json(resp)
# result$login  # your GitHub username
cat('Token from env:', if(nchar(token)>0) 'found' else 'missing')

Budowanie wielokrotnego użytku klienta API

Umieść bazowy adres URL, uwierzytelnianie i obsługę błędów w funkcji konstruktora. Każdy endpoint API staje się metodą wywołującą tę funkcję bazową — to standardowy wzorzec stosowany w pakietach API dla R.

library(httr2)

# API client constructor
new_api_client <- function(base_url, token) {
  list(
    base_req = request(base_url) |>
      req_auth_bearer_token(token) |>
      req_headers('Accept' = 'application/json') |>
      req_retry(max_tries = 3)
  )
}

# Method: GET /users
get_users <- function(client, page = 1, size = 20) {
  resp <- client$base_req |>
    req_url_path_append('users') |>
    req_url_query(page = page, size = size) |>
    req_perform() |>
    resp_check_status()
  resp_body_json(resp, simplifyVector = TRUE)
}

# client <- new_api_client('https://api.example.com', token)
# users <- get_users(client, page = 1)
cat('Reusable client pattern: base request + methods')

Stronicowanie z resp_link_url()

Wiele interfejsów API korzysta z nagłówków Link do stronicowania (RFC 5988): odpowiedź zawiera nagłówek Link: <url>; rel="next". Funkcja resp_link_url(resp, 'next') automatycznie wyodrębnia adres URL następnej strony.

library(httr2)

# Generic paginator using Link headers
fetch_all_pages <- function(initial_url, token, max_pages = 50) {
  all_results <- list()
  next_url <- initial_url
  page <- 1
  while (!is.null(next_url) && page <= max_pages) {
    resp <- request(next_url) |>
      req_auth_bearer_token(token) |>
      req_perform() |>
      resp_check_status()
    all_results[[page]] <- resp_body_json(resp, simplifyVector = TRUE)
    # Follow Link: <url>; rel='next' header
    next_url <- tryCatch(
      resp_link_url(resp, 'next'),
      error = function(e) NULL
    )
    page <- page + 1
  }
  do.call(rbind, all_results)
}
cat('resp_link_url() follows RFC 5988 pagination')

Stronicowanie oparte na kursorze

Niektóre interfejsy API (Twitter, Slack) używają kursorów zamiast numerów stron. Odpowiedź zawiera pole next_cursor lub next_page_token. Przekaż je jako parametr zapytania w następnym żądaniu.

library(httr2)

# Cursor-based pagination pattern
fetch_cursor_pages <- function(base_url, token, max_pages = 100) {
  all_data <- list()
  cursor <- NULL
  page <- 1
  repeat {
    req <- request(base_url) |>
      req_auth_bearer_token(token)
    if (!is.null(cursor))
      req <- req |> req_url_query(cursor = cursor)
    resp <- req |> req_perform() |> resp_check_status()
    body <- resp_body_json(resp)
    all_data[[page]] <- body$results
    cursor <- body$next_cursor  # NULL if last page
    if (is.null(cursor) || page >= max_pages) break
    page <- page + 1
  }
  do.call(c, all_data)
}
cat('Cursor pagination: safer for large/changing datasets')

Sprawna obsługa błędów

Klient API używany produkcyjnie powinien osobno przechwytywać błędy HTTP i awarie sieci. Użyj tryCatch() wokół req_perform() i przeanalizuj warunek błędu httr2_http_*, aby obsługiwać poszczególne statusy.

library(httr2)

safe_api_call <- function(req) {
  tryCatch(
    req |> req_perform() |> resp_check_status(),
    httr2_http_401 = function(e) {
      stop('Authentication failed. Check your token.')
    },
    httr2_http_403 = function(e) {
      stop('Forbidden. Insufficient permissions.')
    },
    httr2_http_404 = function(e) {
      message('Resource not found, returning NULL')
      return(NULL)
    },
    httr2_http_429 = function(e) {
      stop('Rate limit exceeded. Try again later.')
    },
    error = function(e) {
      stop(paste('Request failed:', conditionMessage(e)))
    }
  )
}
cat('Match on specific httr2_http_NNN conditions')

Buforowanie odpowiedzi API

Buforuj odpowiedzi API, aby uniknąć niepotrzebnych żądań podczas pracy nad kodem. Funkcja req_cache() w httr2 zapisuje odpowiedzi w pamięci podręcznej na dysku, respektując nagłówki Cache-Control. Ręczne buforowanie działa z dowolnym interfejsem API.

library(httr2)

# httr2 built-in disk cache
# resp <- request('https://api.example.com/static-data') |>
#   req_cache(tempdir(), max_age = 3600) |>  # 1 hour TTL
#   req_perform()

# Manual cache pattern
cached_api_call <- function(url, cache_file, max_age = 3600) {
  if (file.exists(cache_file)) {
    age <- as.numeric(Sys.time() - file.mtime(cache_file))
    if (age < max_age) {
      cat('Cache hit\n')
      return(readRDS(cache_file))
    }
  }
  cat('Cache miss, fetching...\n')
  # result <- resp_body_json(request(url) |> req_perform())
  # saveRDS(result, cache_file)
  # result
}
cached_api_call('https://example.com/api', 'cache.rds')

Żądania równoległe z req_perform_parallel()

req_perform_parallel() wysyła wiele żądań jednocześnie, znacznie skracając łączny czas operacji wsadowych. Połącz ją z req_throttle(), aby podczas wykonywania równoległego przestrzegać ograniczeń częstotliwości.

library(httr2)

# Build a list of requests
item_ids <- 1:5
reqs <- lapply(item_ids, function(id) {
  request(paste0('https://jsonplaceholder.typicode.com/todos/', id))
})

# Execute all in parallel (requires internet)
# resps <- req_perform_parallel(
#   reqs,
#   on_error = 'continue',  # skip failures
#   progress = TRUE
# )
# results <- lapply(resps, resp_body_json)
# titles <- sapply(results, function(r) r$title)
# print(titles)

# on_error options:
# 'stop'     -> abort on first failure
# 'continue' -> collect errors, keep going
cat('Parallel: much faster for many independent calls')

Praca z ograniczeniami częstotliwości

Interfejsy API przekazują informacje o ograniczeniach częstotliwości w nagłówkach odpowiedzi: X-RateLimit-Remaining, X-RateLimit-Reset i Retry-After. Odczytaj je, aby zaimplementować inteligentne zwiększanie odstępów między próbami.

library(httr2)

respect_rate_limit <- function(resp) {
  # Check remaining calls
  remaining <- resp_header(resp, 'x-ratelimit-remaining')
  if (!is.na(remaining) && as.integer(remaining) < 5) {
    reset_at <- as.integer(
      resp_header(resp, 'x-ratelimit-reset')
    )
    wait_secs <- max(0, reset_at - as.integer(Sys.time()))
    cat(sprintf('Rate limit nearly exhausted. Waiting %ds\n', wait_secs))
    # Sys.sleep(wait_secs)
  }
  # Handle 429 Retry-After header
  if (resp_status(resp) == 429) {
    retry_after <- resp_header(resp, 'retry-after')
    cat(sprintf('Rate limited. Retry after %s seconds\n', retry_after))
  }
  resp
}
cat('Always respect X-RateLimit-* headers')

Pełny klient API: przykład z GitHub

Połączmy wszystkie elementy: kompletny klient GitHub API, który uwierzytelnia użytkownika, pobiera stronicowane listy repozytoriów i obsługuje błędy, demonstrując wszystkie omówione dotąd wzorce.

library(httr2)

# GitHub API client
github_repos <- function(username, token = NULL, n_pages = 3) {
  base <- 'https://api.github.com'
  req_base <- request(base) |>
    req_headers(
      'Accept'     = 'application/vnd.github.v3+json',
      'User-Agent' = 'R-API-Client/1.0'
    )
  if (!is.null(token))
    req_base <- req_base |> req_auth_bearer_token(token)

  all_repos <- list()
  for (page in seq_len(n_pages)) {
    # resp <- req_base |>
    #   req_url_path_append('users', username, 'repos') |>
    #   req_url_query(page = page, per_page = 30, sort = 'updated') |>
    #   req_perform() |> resp_check_status()
    # repos <- resp_body_json(resp, simplifyVector = TRUE)
    # if (length(repos) == 0) break
    # all_repos[[page]] <- repos
    cat(sprintf('Would fetch page %d for %s\n', page, username))
  }
  do.call(rbind, all_repos)
}
github_repos('hadley')

Poświadczenia klienta OAuth 2.0

Niektóre interfejsy API wymagają przepływu poświadczeń klienta OAuth 2.0: wymiany client_id + client_secret na token dostępu. Funkcje oauth_client() i req_oauth_client_credentials() w httr2 obsługują ten proces automatycznie.

library(httr2)

# OAuth 2.0 Client Credentials flow:
# client <- oauth_client(
#   id     = Sys.getenv('CLIENT_ID'),
#   secret = Sys.getenv('CLIENT_SECRET'),
#   token_url = 'https://auth.example.com/oauth/token'
# )

# Automatic token management:
# resp <- request('https://api.example.com/data') |>
#   req_oauth_client_credentials(client) |>
#   req_perform()
# httr2 automatically:
# 1. Gets access token using client credentials
# 2. Adds 'Authorization: Bearer <token>' header
# 3. Refreshes token when expired

cat('req_oauth_client_credentials() handles token lifecycle')
cat('Token is cached in memory automatically')

Szybki test

Sprawdź, czy rozumie Pan/Pani, jak budować klientów REST API w języku R za pomocą httr2.

Podsumowanie: korzystanie z interfejsów REST API

Najważniejsze informacje: Twórz klientów wielokrotnego użytku, umieszczając bazowy adres URL, uwierzytelnianie i ponawianie prób w konstruktorze. Do uwierzytelniania używaj req_auth_bearer_token() — tokeny przechowuj w zmiennych środowiskowych. Obsługuj stronicowanie za pomocą nagłówków Link i funkcji resp_link_url() lub wzorców opartych na kursorach. Zawsze obsługuj błędy HTTP za pomocą resp_check_status() i tryCatch(). Do wywołań wsadowych używaj req_perform_parallel(). Podczas pracy nad kodem buforuj wyniki.

library(httr2)

# REST API client template:
make_api_call <- function(url, token,
                          method = 'GET',
                          body = NULL,
                          query = list()) {
  req <- request(url) |>
    req_method(method) |>
    req_auth_bearer_token(token) |>
    req_headers('Accept' = 'application/json') |>
    req_retry(max_tries = 3) |>
    req_throttle(rate = 10/60)
  if (length(query) > 0)
    req <- do.call(req_url_query, c(list(req), query))
  if (!is.null(body))
    req <- req |> req_body_json(body)
  req |> req_perform() |> resp_check_status()
}
cat('Template: auth + retry + throttle + error check')

Często zadawane pytania

Czy lekcja „Korzystanie z REST API w R” jest bezpłatna?

Tak — pełny tekst „Korzystanie z REST API w R” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu R Academy, przejdź na CoddyKit PRO. Kurs R Academy zawiera 4 lekcji w sumie.

Co nauczysz się w „Korzystanie z REST API w R”?

Uwierzytelniaj się za pomocą kluczy API, stronicuj wyniki i zapisuj odpowiedzi API. Ćwiczysz R Academy z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.

Czy potrzebuję doświadczenia, aby zacząć R Academy?

Nie wymagamy żadnego doświadczenia. R Academy w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 3 z 4.

Ile czasu zajmuje lekcja „Korzystanie z REST API w R”?

Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.

Czy mogę pisać i uruchamiać kod w tej lekcji R Academy?

Tak. Każda lekcja R Academy zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.

Wszystkie lekcje w tym kursie

  1. Parsowanie JSON za pomocą jsonlite
  2. Wysyłanie żądań HTTP za pomocą httr2
  3. Korzystanie z REST API w R
  4. Obsługa zagnieżdżonych struktur JSON
← Powrót do R Academy