Web Scraping & Bots · Урок

Управление сеансами и файлами cookie

Узнайте, как боты сохраняют состояние между запросами с помощью сеансов, файлов cookie и токенов, поддерживая аутентифицированные многошаговые процессы.

Урок 4 из 413 шагов

«Управление сеансами и файлами cookie» — бесплатный урок Web Scraping & Bots на CoddyKit. Это урок 4 из 4. Ты можешь прочитать весь урок бесплатно ниже — а потом практиковать его прямо в браузере с встроенным редактором кода и ИИ-репетитором 24/7. Это часть пути обучения Web Scraping & Bots, и твой прогресс синхронизируется между веб-версией и приложением CoddyKit. Курс Web Scraping & Bots содержит 4 уроков всего.

Части этого урока еще не переведены и отображаются на английском.

HTTP Is Stateless

Each HTTP request is independent: the server forgets you between calls. To build multi-step workflows, a bot must carry state itself.

Cookies and sessions are how that state travels between requests.

What a Cookie Is

A cookie is a small key-value pair the server sets via a Set-Cookie header. The client returns it on every subsequent request, letting the server recognize the same client.

Set-Cookie: session_id=abc123; Path=/; HttpOnly

Session Objects

The requests.Session object automatically stores and resends cookies across requests, so a login persists for the rest of your workflow.

import requests

session = requests.Session()
session.post('https://site.com/login', data={'user': 'a', 'pass': 'b'})
# cookies now persist on subsequent calls
profile = session.get('https://site.com/profile')

Inspecting Cookies

You can read what cookies a session holds. This helps debug why an authenticated request unexpectedly redirects to a login page.

for c in session.cookies:
    print(c.name, '=', c.value)

Setting Cookies Manually

Sometimes you obtain a cookie elsewhere (a browser export) and inject it into your session to skip the login step.

session.cookies.set('session_id', 'abc123', domain='site.com')

CSRF Tokens

Forms often embed a hidden CSRF token that must be sent back on submit. Scrape it from the page first, then include it in your POST.

page = session.get('https://site.com/form')
token = extract_hidden(page.text, 'csrf_token')
session.post('https://site.com/form', data={'csrf_token': token, 'msg': 'hi'})

Bearer Tokens

API-driven sites issue a token after login that you send in an Authorization header rather than as a cookie. Store it and attach it to every call.

token = login_resp.json()['access_token']
session.headers.update({'Authorization': 'Bearer ' + token})

Persisting Sessions to Disk

To resume a workflow later without re-authenticating, serialize the cookie jar and reload it on the next run.

import pickle

with open('cookies.pkl', 'wb') as f:
    pickle.dump(session.cookies, f)

# later
with open('cookies.pkl', 'rb') as f:
    session.cookies.update(pickle.load(f))

Handling Expiry

Sessions and tokens expire. Detect a redirect to login or a 401 response, then re-authenticate transparently before retrying the original request.

resp = session.get(url)
if resp.status_code == 401:
    relogin(session)
    resp = session.get(url)

Sessions in Selenium

In a browser-driven bot, Selenium manages cookies for you. You can still read or transplant them between a requests.Session and the browser to share authentication.

for c in driver.get_cookies():
    session.cookies.set(c['name'], c['value'])

Security of Stored Sessions

A saved cookie jar is as sensitive as a password: anyone with it can act as you. Store session files with restricted permissions and never commit them to version control.

import os
os.chmod('cookies.pkl', 0o600)  # owner read/write only

Quick Check

Test your understanding of session management.

Recap

You learned how bots maintain state: cookies, requests.Session, CSRF and bearer tokens, persisting cookies to disk, handling expiry with re-login, and sharing auth between Selenium and requests.

Managing sessions is essential for any authenticated multi-step workflow.

Можно начать бесплатно

Изучай Python с ИИ-репетитором — бесплатно

Пиши и запускай код прямо в браузере, получай мгновенную помощь от ИИ-репетитора 24/7 и продолжи учиться на сайте или в приложении.

Курсы
12
Уроки
48

Часто задаваемые вопросы

Урок «Управление сеансами и файлами cookie» бесплатный?

Да — полный текст урока «Управление сеансами и файлами cookie» бесплатно доступен здесь в веб-версии. Чтобы практиковать его интерактивно (встроенный редактор кода и ИИ-репетитор 24/7) и разблокировать остальной курс Web Scraping & Bots, подпишись на CoddyKit PRO. Курс Web Scraping & Bots содержит 4 уроков всего.

Чему я научусь в уроке «Управление сеансами и файлами cookie»?

Узнайте, как боты сохраняют состояние между запросами с помощью сеансов, файлов cookie и токенов, поддерживая аутентифицированные многошаговые процессы. Ты практикуешь Web Scraping & Bots с помощью реального кода, который запускаешь прямо в браузере, и ИИ-репетитор 24/7 отвечает на твои вопросы во время урока.

Нужен ли мне опыт, чтобы начать Web Scraping & Bots?

Предыдущий опыт не требуется. Web Scraping & Bots на CoddyKit структурирован для всех уровней — от новичков до продвинутых, поэтому ты можешь начать отсюда или с самого начала и учиться в своем темпе. Это урок 4 из 4.

Сколько времени занимает урок «Управление сеансами и файлами cookie»?

Большинство уроков CoddyKit занимают около 5–10 минут. Каждый из них компактный и интерактивный, поэтому ты постоянно делаешь прогресс и продолжаешь с того же места в веб-версии и приложении.

Можно ли писать и запускать код в этом уроке Web Scraping & Bots?

Да. Каждый урок Web Scraping & Bots включает встроенный редактор кода, поэтому ты пишешь и запускаешь реальный код прямо в браузере и получаешь моментальную обратную связь от AI — локальная установка не требуется.

Все уроки этого курса

  1. Обработка аутентификации пользователей
  2. Имитация сложных пользовательских сценариев
  3. Интеграция с API
  4. Управление сеансами и файлами cookie
← Назад к Web Scraping & Bots