Управление сеансами и файлами cookie
Узнайте, как боты сохраняют состояние между запросами с помощью сеансов, файлов cookie и токенов, поддерживая аутентифицированные многошаговые процессы.
«Управление сеансами и файлами cookie» — бесплатный урок Web Scraping & Bots на CoddyKit. Это урок 4 из 4. Ты можешь прочитать весь урок бесплатно ниже — а потом практиковать его прямо в браузере с встроенным редактором кода и ИИ-репетитором 24/7. Это часть пути обучения Web Scraping & Bots, и твой прогресс синхронизируется между веб-версией и приложением CoddyKit. Курс Web Scraping & Bots содержит 4 уроков всего.
Части этого урока еще не переведены и отображаются на английском.
HTTP Is Stateless
Each HTTP request is independent: the server forgets you between calls. To build multi-step workflows, a bot must carry state itself.
Cookies and sessions are how that state travels between requests.
What a Cookie Is
A cookie is a small key-value pair the server sets via a Set-Cookie header. The client returns it on every subsequent request, letting the server recognize the same client.
Set-Cookie: session_id=abc123; Path=/; HttpOnlySession Objects
The requests.Session object automatically stores and resends cookies across requests, so a login persists for the rest of your workflow.
import requests
session = requests.Session()
session.post('https://site.com/login', data={'user': 'a', 'pass': 'b'})
# cookies now persist on subsequent calls
profile = session.get('https://site.com/profile')Inspecting Cookies
You can read what cookies a session holds. This helps debug why an authenticated request unexpectedly redirects to a login page.
for c in session.cookies:
print(c.name, '=', c.value)Setting Cookies Manually
Sometimes you obtain a cookie elsewhere (a browser export) and inject it into your session to skip the login step.
session.cookies.set('session_id', 'abc123', domain='site.com')CSRF Tokens
Forms often embed a hidden CSRF token that must be sent back on submit. Scrape it from the page first, then include it in your POST.
page = session.get('https://site.com/form')
token = extract_hidden(page.text, 'csrf_token')
session.post('https://site.com/form', data={'csrf_token': token, 'msg': 'hi'})Bearer Tokens
API-driven sites issue a token after login that you send in an Authorization header rather than as a cookie. Store it and attach it to every call.
token = login_resp.json()['access_token']
session.headers.update({'Authorization': 'Bearer ' + token})Persisting Sessions to Disk
To resume a workflow later without re-authenticating, serialize the cookie jar and reload it on the next run.
import pickle
with open('cookies.pkl', 'wb') as f:
pickle.dump(session.cookies, f)
# later
with open('cookies.pkl', 'rb') as f:
session.cookies.update(pickle.load(f))Handling Expiry
Sessions and tokens expire. Detect a redirect to login or a 401 response, then re-authenticate transparently before retrying the original request.
resp = session.get(url)
if resp.status_code == 401:
relogin(session)
resp = session.get(url)Sessions in Selenium
In a browser-driven bot, Selenium manages cookies for you. You can still read or transplant them between a requests.Session and the browser to share authentication.
for c in driver.get_cookies():
session.cookies.set(c['name'], c['value'])Security of Stored Sessions
A saved cookie jar is as sensitive as a password: anyone with it can act as you. Store session files with restricted permissions and never commit them to version control.
import os
os.chmod('cookies.pkl', 0o600) # owner read/write onlyQuick Check
Test your understanding of session management.
Recap
You learned how bots maintain state: cookies, requests.Session, CSRF and bearer tokens, persisting cookies to disk, handling expiry with re-login, and sharing auth between Selenium and requests.
Managing sessions is essential for any authenticated multi-step workflow.
Изучай Python с ИИ-репетитором — бесплатно
Пиши и запускай код прямо в браузере, получай мгновенную помощь от ИИ-репетитора 24/7 и продолжи учиться на сайте или в приложении.
- Курсы
- 12
- Уроки
- 48
Часто задаваемые вопросы
Урок «Управление сеансами и файлами cookie» бесплатный?
Да — полный текст урока «Управление сеансами и файлами cookie» бесплатно доступен здесь в веб-версии. Чтобы практиковать его интерактивно (встроенный редактор кода и ИИ-репетитор 24/7) и разблокировать остальной курс Web Scraping & Bots, подпишись на CoddyKit PRO. Курс Web Scraping & Bots содержит 4 уроков всего.
Чему я научусь в уроке «Управление сеансами и файлами cookie»?
Узнайте, как боты сохраняют состояние между запросами с помощью сеансов, файлов cookie и токенов, поддерживая аутентифицированные многошаговые процессы. Ты практикуешь Web Scraping & Bots с помощью реального кода, который запускаешь прямо в браузере, и ИИ-репетитор 24/7 отвечает на твои вопросы во время урока.
Нужен ли мне опыт, чтобы начать Web Scraping & Bots?
Предыдущий опыт не требуется. Web Scraping & Bots на CoddyKit структурирован для всех уровней — от новичков до продвинутых, поэтому ты можешь начать отсюда или с самого начала и учиться в своем темпе. Это урок 4 из 4.
Сколько времени занимает урок «Управление сеансами и файлами cookie»?
Большинство уроков CoddyKit занимают около 5–10 минут. Каждый из них компактный и интерактивный, поэтому ты постоянно делаешь прогресс и продолжаешь с того же места в веб-версии и приложении.
Можно ли писать и запускать код в этом уроке Web Scraping & Bots?
Да. Каждый урок Web Scraping & Bots включает встроенный редактор кода, поэтому ты пишешь и запускаешь реальный код прямо в браузере и получаешь моментальную обратную связь от AI — локальная установка не требуется.
Все уроки этого курса
- Обработка аутентификации пользователей
- Имитация сложных пользовательских сценариев
- Интеграция с API
- Управление сеансами и файлами cookie