* Cantinho Satkeys

Refresh History
  • xifanwaifan11: ja
    18 de Julho de 2025, 11:44
  • JPratas: try65hytr A Todos  4tj97u<z classic k7y8j0
    18 de Julho de 2025, 05:11
  • cunha45: Entendido
    16 de Julho de 2025, 20:33
  • j.s.: reafirmo 15/07/2026 o forum encerra
    16 de Julho de 2025, 18:26
  • j.s.: o que foi dito é que este ano está pago, e para bom entendedor foi dito que após desinteresse nos membros, ficam já avisados que a 15/07/2026
    16 de Julho de 2025, 18:25
  • j.s.: boa tarde
    16 de Julho de 2025, 18:22
  • cunha45: Com a colaboração de 6 membros, aos quais agradecemos e com custos muito elevados, por parte da administração, foi pago mais um ano , do domínio e nome do fórum, num servidor externo.  Como o fórum é dos dos seus membros, e como estes mostraram total desinteresse numa pequena ajuda para a sua manutenção informamos que  a partir de 15/07/2026 o fórum encerra as suas portas.  Para todos os membros que não nos quiseram ajudar, e que fazem neste fórum, os seus downloads do que aqui disponibilizamos, para seu proveito e de borla, iremos cancelar essa função, apenas podendo vizualizar o forum.  A administação
    16 de Julho de 2025, 13:43
  • cunha45: ainda nao encerrou
    16 de Julho de 2025, 13:42
  • FELISCUNHA: ghyt74  pessoal   49E09B4F
    16 de Julho de 2025, 11:46
  • m1957: Obrigado pelo cuidado em informar!
    16 de Julho de 2025, 00:45
  • cereal killa: boas gomes, 4tj97u<z
    14 de Julho de 2025, 21:32
  • j.s.: cereal enviei pm  4tj97u<z
    14 de Julho de 2025, 21:13
  • j.s.: Entre as 20h do dia 13 de agosto de 2025 e as 10h do dia 14 de agosto de 2025 (horário CEST).
    14 de Julho de 2025, 20:55
  • j.s.: foi refeita nova data para migração
    14 de Julho de 2025, 20:55
  • j.s.: 43e5r6
    14 de Julho de 2025, 16:49
  • j.s.: por isso o forum deve estar off line  Início: 16/07/2025 às 20:00 (CEST) Fim: 17/07/2025 às 10:00 (CEST)
    14 de Julho de 2025, 16:49
  • j.s.: vai ser efectuada migração de servidores
    14 de Julho de 2025, 16:48
  • j.s.: dgtgtr a todosc 49E09B4F
    14 de Julho de 2025, 16:47
  • cunha45: ja
    14 de Julho de 2025, 08:25
  • j.s.: passem por aqui p.f. [link]
    13 de Julho de 2025, 16:29

Autor Tópico: Python Web Scraping using Bs4, Requests, Multiprocessing  (Lida 116 vezes)

0 Membros e 1 Visitante estão a ver este tópico.

Offline mitsumi

  • Sub-Administrador
  • ****
  • Mensagens: 121842
  • Karma: +0/-0
Python Web Scraping using Bs4, Requests, Multiprocessing
« em: 21 de Julho de 2021, 16:37 »
MP4 | Video: h264, 1280x720 | Audio: AAC, 48 KHz, 2 Ch
Genre: eLearning | Language: English + .srt | Duration: 8 lectures (57 mins) | Size: 500 MB
Modern parsing of sites in Python using advanced technologies

What you'll learn

About the course
An introduction to requests. Installing modules and writing first programs
Examining bs4 and query structure. Fake user-agent and other headers
Authorization on the site. Examining sessions, retrieving and import cookies into request
Parsing the entire site and downloading files inside it
Using a proxy. Learning multiprocessing for accelerated parsing
Using JSON configs to customize the parser
Bonus lecture. Conclusion

Requirements

Minimum knowledge of Python

Description

We will learn to:
- work with requests
- extract the necessary data from the page
- consider GET, POST requests
- consider headers, data arguments
- learn how to create a session to save cookies
- learn to simulate user actions
- learn how to log in to sites, download and send files
- study the architecture client/server
- we will look at the principle of thehttp protocol
- we will learn how to parse all the pages of the site
- we will learn how to find the values ​​we need on the website
- we will look at multiprocessor programs, to speed up the work of the software
- we will learn to replace the user-agent and simulate another device and browser
- we will consider all the basics bs4

Will we do it?
- write a program to extract the user's IP
- write a program to download files from the site
- learn to bypass all the pages of the site and replace the user-agent
- write a program using multiprocessing
- write a program using bs4

Why this particular course?
- the material is aimed at any level of knowledge of Python (suitable for a beginner and p professional)

- the course does not contain water and provides only the necessary information
- after this course you will be able to fully work with the studied libraries
- simple presentation of the material
- contains real examples and tasks
- relevant information
- we consider all the listed libraries in one course at a minimal cost

After completing this course you will be able to develop parsers, creators, various bots to automate actions in the browser and simulate all actions that a person can perform using a browser and certain sites. Services of parsing and automation of web resources are very often found on freelance, so you can recoup this knowledge almost immediately after passing the course.
Who this course is for:

Beginner Python developers who want to learn how to use site scraping in their work
Python developers who want to learn how to parse data

Screenshots


Download link:
Só visivel para registados e com resposta ao tópico.

Only visible to registered and with a reply to the topic.

Links are Interchangeable - No Password - Single Extraction