Upgrade to Pro
— share decks privately, control downloads, hide ads and more …
Speaker Deck
Features
Speaker Deck
PRO
Sign in
Sign up for free
Search
Search
Web scraping, python, e ordem da câmara dos ver...
Search
Sponsored
·
Your Podcast. Everywhere. Effortlessly.
Share. Educate. Inspire. Entertain. You do you. We'll handle the rest.
→
Gabriela
November 02, 2020
55
1
Share
Web scraping, python, e ordem da câmara dos vereadores
Gabriela
November 02, 2020
More Decks by Gabriela
See All by Gabriela
Python: O poder da linguagem, diversidade e mercado de trabalho
gabicavalcante
0
110
Desbravando Comunidades
gabicavalcante
0
34
Featured
See All Featured
Writing Fast Ruby
sferik
630
63k
Dominate Local Search Results - an insider guide to GBP, reviews, and Local SEO
greggifford
PRO
0
130
YesSQL, Process and Tooling at Scale
rocio
174
15k
What Being in a Rock Band Can Teach Us About Real World SEO
427marketing
0
200
Why You Should Never Use an ORM
jnunemaker
PRO
61
9.8k
Stewardship and Sustainability of Urban and Community Forests
pwiseman
0
170
Side Projects
sachag
455
43k
The #1 spot is gone: here's how to win anyway
tamaranovitovic
2
1k
HU Berlin: Industrial-Strength Natural Language Processing with spaCy and Prodigy
inesmontani
PRO
0
310
Visualizing Your Data: Incorporating Mongo into Loggly Infrastructure
mongodb
49
9.9k
The Spectacular Lies of Maps
axbom
PRO
1
680
How to Create Impact in a Changing Tech Landscape [PerfNow 2023]
tammyeverts
55
3.3k
Transcript
Web scraping, python, e ordem da câmara dos vereadores 01
Gabi Cavalcante 02 ❯ natalense ❯ 25 anos ❯ TI
❯ @stone-payments ❯ @twilio ❯ autenticação e autorização. e-commerce. chatbots. ❯ ciência de dados/ETL; QE; teste; arquitetura. ❯ PyLadies Natal
❯❯ Web scraping ❯ Python ❯ Ordem da câmara 03
04 a construção de um agente para baixar, analisar e
organizar dados da Web de maneira automatizada fonte: Practical Web Scraping for Data Science (Broucke and Baesens).
05
❯ Web scraping ❯❯ Python ❯ Ordem da câmara 06
❯ Web scraping ❯ Python ❯❯ Ordem da câmara 07
08
Título de CIDADÃO NATALENSE 09
RESULTADOS Total de pautas: Títulos: 1773 21 - 1.18% 10
11
RESULTADOS Total de pautas: Títulos: 1773 1080 - 60.91% 12
O QUE USEI PRA RASPAR 13 ❯ bs4 ❯ scrapy
❯ requests-html
14
15
16
O QUE USEI PRA EXTRAIR 17 ❯ PyPDF2 + regex
❯ pdfPlumber ❯ rows ++
DICAS [1] Python Assíncrono: tudo ao mesmo tempo agora -
Luciano Ramalho [2] rows [2] blog do scrapy 18 CONTRIBUA [1] Brasil.io [2] Querido diário [3] Dados Abertos de Feira
DÚVIDAS? me encontrem: Twitter: @_gabicavalcante Telegram: @gabrilas GitHub: gabicavalcante 19