Jour 1 — Télécharger et parser
- Révision du protocole HTTP : méthodes, headers, codes de statut
- Requests et httpx
- Les encodages, ou pourquoi vos accents sont devenus illisibles
- Parser du HTML avec BeautifulSoup, lxml et selectolax
- S'y retrouver avec les sélecteurs CSS et XPath
- Formulaires, sessions et cookies
- L'API cachée derrière la page : lire l'onglet réseau
- Les sites bourrés de JavaScript : piloter un navigateur avec Playwright
- Stocker les résultats en CSV et SQLite