Skip to main content

JobScraper, um pacote de raspagem de vagas na internet.

Reason this release was yanked:

unconventional root name

Project description

Projeto JobScraper - Centralize as Vagas Online

O JobScraper é usado puramente para recolher vagas de empregos nos domínios especificados abaixo, os centralizando em um arquivo .xlsx:

  • LinkedIn
  • Vagas.com
  • Catho
  • Glassdoor

Instalação

Use o gerenciador de pacotes pip para instalar o JobScraper:

pip install jb-scraper

Utilização

from jb_scraper import JobScraper

# Coloque suas pesquisas em uma lista.
query_list = [
    "query 1",
    "query 2",
    "query 3",
    "query n",
]

# Crie o objeto com a classe JobScraper.
objeto = JobScraper(
    domain="palavra-chave",  # Consulte as palavras-chave
    archive_name="sua-escolha",
    query=query_list,
)

# Instancie o objeto com o sequinte método.
objeto.create_archive()

A execução deste código irá ativar o Selenium, recolher os dados das vagas e armazená-los em um arquivo .xlsx, que por ventura será criado no mesmo local onde está localizado o módulo de execução deste pacote.

Sobre o arquivo .xlsx

Como anteriormente dito, o arquivo será criado no diretório do módulo de execução, o nome deste será decidido no momento de criação do objeto. Em casos de arquivos com o mesmo nome, este será simplesmente atualizado.

Arquivos .xlsx possuem planilhas, estas são nomeadas de acordo com a palavra- chave utilizada no parâmetro "dominio", na criação do objeto. Em situações onde o usuário utilize o mesmo nome de arquivo em uma pesquisa nova, em adição a isso, o mesmo nome de planilha, todos os dados da planilha antiga serão apagados e novos dados serão postos no lugar, fique ciente disso.

Em casos de arquivos com o mesmo nome, porém planilhas com nomes diferentes, uma nova planilha será adicionada ao arquivo já existente.

Palavras-chave

  • "linkedin" --- Domínio Utilizado: LinkedIn --- Nome da Planilha: "linkedin"

  • "vagas.com" --- Domínio Utilizado: Vagas.com --- Nome da Planilha: "vagas.com"

  • "catho" --- Domínio Utilizado: Catho --- Nome da Planilha: "catho"

  • "glassdoor" --- Domínio Utilizado: Vagas.com --- Nome da Planilha: "glassdoor"

Sobre os domínios

Há alguns domínios que exigem login, ou informação adicional, como localidade das vagas e afins. Para tanto, é necessário exemplificar as peculiaridades de cada site envolvido no scraping.

LinkedIn

O LinkedIn não irá fazer o scraping imediatamente, para acessar as vagas é preciso fazer o login com a sua conta, no site. Assim que tal ação for feita, o script continuará normalmente. A localidade usada será a configurada na sua conta do LinkedIn.

Vagas.com

O site Vagas.com terá a query concatenada com a localidade, "cidade estado" ou apenas "estado(por extenso)".

Catho

Usará os dados da query e em seguida, a localidade inserida no parâmetro, certifique-se de usar um local válido, "cidade estado(abreviado)" ou apenas "estado(sigla)".

Glassdoor

Usará os dados da query e em seguida, a localidade inserida no parâmetro, certifique-se de usar um local válido, "cidade estado" ou apenas "estado".

Desenvolvedor

Lucas Aquino de Oliveira --- Meu LinkedIn

Licença

MIT

Project details


Download files

Download the file for your platform. If you're not sure which to choose, learn more about installing packages.

Source Distribution

jb_scraper-0.0.1.tar.gz (5.3 kB view details)

Uploaded Source

Built Distribution

If you're not sure about the file name format, learn more about wheel file names.

jb_scraper-0.0.1-py3-none-any.whl (5.4 kB view details)

Uploaded Python 3

File details

Details for the file jb_scraper-0.0.1.tar.gz.

File metadata

  • Download URL: jb_scraper-0.0.1.tar.gz
  • Upload date:
  • Size: 5.3 kB
  • Tags: Source
  • Uploaded using Trusted Publishing? No
  • Uploaded via: twine/6.1.0 CPython/3.12.6

File hashes

Hashes for jb_scraper-0.0.1.tar.gz
Algorithm Hash digest
SHA256 a3a3844d0f053b3b9cb0ca1043806d714ffe9c353a7f8617b24f0b36c5532b4d
MD5 b5011f11cbc576ff186121bc749ce9c3
BLAKE2b-256 8a51725feaa96864e562950dd9658bfe52487b67ede08db2a7d4f2356d861f7b

See more details on using hashes here.

File details

Details for the file jb_scraper-0.0.1-py3-none-any.whl.

File metadata

  • Download URL: jb_scraper-0.0.1-py3-none-any.whl
  • Upload date:
  • Size: 5.4 kB
  • Tags: Python 3
  • Uploaded using Trusted Publishing? No
  • Uploaded via: twine/6.1.0 CPython/3.12.6

File hashes

Hashes for jb_scraper-0.0.1-py3-none-any.whl
Algorithm Hash digest
SHA256 819b770c0491433eba037588b967714c44d43ac13695d8b037c64e71ff3c4761
MD5 f3170b8b0a6e8b3dececd93b702b79fd
BLAKE2b-256 8468bcebd40cbc56e888b81eb7abcde5ea36914f9bc2d718720b82c48fc58234

See more details on using hashes here.

Supported by

AWS Cloud computing and Security Sponsor Datadog Monitoring Depot Continuous Integration Fastly CDN Google Download Analytics Pingdom Monitoring Sentry Error logging StatusPage Status page