Este projeto de Data Science utiliza Python e BeautifulSoup para realizar web scraping das avaliações e detalhes dos melhores livros do Goodreads. O objetivo é extrair informações como título, autor e avaliação dos livros destacados na lista "Best Books Ever" do Goodreads e salvar esses dados em um arquivo CSV para análise posterior.
- Extração de dados de livros (título, autor, avaliação) da lista "Best Books Ever" do Goodreads
- Salvamento dos dados extraídos em um arquivo CSV
- Análise e visualização dos dados extraídos
- Python
- BeautifulSoup (para web scraping)
- Pandas (para manipulação de dados)
- Matplotlib (para visualização de dados)
O projeto está em fase de desenvolvimento. As funcionalidades básicas foram implementadas, mas ainda há melhorias e ajustes planejados, incluindo:
- Adição de mais campos de dados dos livros
- Melhorias na robustez do scraping (tratamento de erros, verificação de conectividade)
- Análises de dados mais avançadas
|
dafnirca |