Web Scraping e extração de dados em estruturas HTML com visualização em interface web: um estudo de caso
Data
Autor(es)
Orientado(es)
Título da Revista
ISSN da Revista
Título de Volume
Editor
Resumo
O mercado de itens virtuais em jogos eletrônicos tem se expandido significativamente, em títulos como Counter-Strike, onde skins podem alcançar alto valor comercial. Diante da oscilação constante de preços entre plataformas, o acesso a dados atualizados é fundamental para subsidiar decisões de compra. Este trabalho apresenta um estudo de caso e a implementação de um sistema automatizado para coleta e centralização, em tempo real, de informações sobre skins de Counter-Strike, a partir de cinco plataformas especializadas. A extração foi realizada com a biblioteca Selenium, em conjunto com WebDriver e undetected_chromedriver, visando contornar sistemas anti-bot. As informações coletadas, nome do item, preço, tipo de acabamento, nível de desgaste (float) e imagem, foram extraídas com base em seletores específicos de tags HTML, como , e tratadas com a biblioteca pandas para padronização e posterior análise. A visualização
dos dados foi realizada por meio de uma interface interativa desenvolvida com Dash Bootstrap, facilitando a navegação e análise por parte do usuário. A aplicação também foi otimizada com o uso de threads, permitindo maior agilidade no processo de coleta, especialmente em ambientes com múltiplas fontes. Adicionalmente, foi implementado um modo de raspagem dinâmica, voltado a usuários com conhecimentos prévios em estruturas
HTML. Esse modo permite a personalização do processo de coleta, possibilitando que o usuário defina manualmente os seletores HTML, o tipo de rolagem da página (paginada, infinita ou alternada), e a URL de destino. Tal funcionalidade expande a aplicabilidade da ferramenta, permitindo que novos sites sejam integrados ao sistema conforme os mesmos princípios técnicos adotados no estudo principal. Entre os principais desafios, destacam-se o carregamento assíncrono via JavaScript e mecanismos de proteção contra automação,
superados com renderização forçada e uso de navegação não detectável. A proposta visa facilitar o acesso e a análise dos dados pelo usuário, promovendo maior eficiência na interpretação dos valores e características dos itens ofertados.
