juscraper
Raspador de tribunais e outros sistemas relacionados ao poder judiciário brasileiro.
📦 Instalação
Via PyPI (Recomendado)
pip install juscraper
Com uv
uv add juscraper
Versão de Desenvolvimento
Para instalar a versão mais recente do repositório:
pip install git+https://github.com/jtrecenti/juscraper.git
🚀 Exemplo Rápido
import juscraper as jus
# Criar scraper para o TJSP
tjsp = jus.scraper('tjsp')
# Buscar jurisprudência
dados = tjsp.cjpg('golpe do pix', paginas=range(1, 4))
print(f"Encontrados {len(dados)} resultados")
# Visualizar primeiros resultados
dados.head()
📊 Implementações
Tribunais Disponíveis
| Tribunal | Funcionalidades Disponíveis |
|---|---|
| TJSP | cpopg, cposg, cjsg, cjpg |
| TJES | cjsg, cjpg |
| TJTO | cjsg, cjpg |
| TJAP | cjsg ⚠️ |
| TJBA | cjsg |
| TJCE | cjsg |
| TJDFT | cjsg |
| TJMT | cjsg |
| TJPA | cjsg |
| TJPB | cjsg |
| TJPE | cjsg |
| TJPI | cjsg |
| TJPR | cjsg |
| TJRN | cjsg |
| TJRO | cjsg |
| TJRR | cjsg |
| TJRS | cjsg |
| TJSC | cjsg |
⚠️ TJAP —
cjsgindisponível: desde ~2026 a busca de jurisprudência do TJAP (plataforma Tucujuris) passou a exigir um CAPTCHA Cloudflare Turnstile, validado no servidor. Como o raspador faz requisições HTTP puras (sem navegador), não há como gerar o token e o backend responde"A verificação de segurança falhou". Nesse casocjsglevantaTJAPSecurityCheckErrorcom a explicação, em vez de retornar vazio silenciosamente. Não há solução pela API pública. Ver issue #279.
Agregadores Disponíveis
| Nome | Funcionalidades |
|---|---|
| Datajud | listar_processos |
| Jusbr | cpopg, download_documents |
| PDPJ | existe, cpopg, documentos, movimentos, partes, pesquisa, contar, download_documents |
Notebooks de Exemplo
- Exemplo TJSP
- Exemplo TJRS
- Exemplo TJPR
- Exemplo TJDFT
- Exemplo TJAP
- Exemplo TJBA
- Exemplo TJCE
- Exemplo TJES
- Exemplo TJMT
- Exemplo TJPA
- Exemplo TJPB
- Exemplo TJPE
- Exemplo TJPI
- Exemplo TJRN
- Exemplo TJRO
- Exemplo TJRR
- Exemplo TJSC
- Exemplo TJTO
- Exemplo Datajud
- Exemplo Jusbr
- Exemplo PDPJ
Detalhes
O pacote foi pensado para atender a requisitos básicos de consulta de dados de processos judiciais em alguns tribunais.
Os tribunais implementados vão apresentar os seguintes métodos:
.cpopg(): consulta de processos originários do primeiro grau.cposg(): consulta de processos originários do segundo grau.cjsg(): consulta de jurisprudência
Os métodos .cpopg() e .cposg() recebem como input um número de processo no padrão CNJ (NNNNNNN-DD.AAAA.J.TT.OOOO), com ou sem separadores, e retorna um dict com tabelas dos elementos do processo (dados básicos, partes, movimentações, entre outros específicos por tribunal).
O método .cjsg() recebe como input parâmetros de busca de jurisprudência (que variam por tribunal) e retorna uma tabela com os resultados da consulta. Boa parte dos tribunais apresentam limites de paginação ao realizar buscas muito gerais (i.e. que retornam muitos resultados). Nesses casos, o método dará um aviso ao usuário com o número total de resultados, confirmando se deseja mesmo baixar todos os resultados.
Controle de arquivos
Caso o usuário queira controlar o armazenamento dos arquivos brutos dos processos, deverá implementar as seguintes funções:
.cpopg_download(): baixa o arquivo bruto da consulta de processos originários do primeiro grau, retornando o caminho do arquivo baixado..cpopg_parse(): lê e processa um arquivo bruto ou arquivos dentro de uma pasta resultantes da consulta de processos, retornando odictcom tabelas dos elementos do processo, como na função.cpopg().
O mesmo se aplica para as funções .cposg_download() e .cposg_parse().
Observação: Em alguns tribunais ou situações específicas, a consulta a um processo pode gerar vários arquivos brutos. Por esse motivo, toda consulta cria uma pasta com o número do processo e, dentro dessa pasta, cria os arquivos correspondentes ao download.
Para a função .cjsg(), uma consulta pode resultar
Diferenciais do juscraper
- Controle sobre arquivos brutos: o pacote fornece uma interface para baixar e armazenar arquivos brutos (HTML e JSON, por exemplo) dos processos. Por padrão, no entanto, esses arquivos brutos são descartados assim que os dados são processados, com exceção dos arquivos que apresentaram algum problema na leitura.
Restrições
Por ser um pacote bastante complexo e também nichado, adotamos algumas restrições sobre o escopo do pacote para que seja simples de usar.
- O pacote não utiliza paralelização, ou seja, se o usuário tiver interesse em realizar requisições em paralelo, deverá desenvolver as adaptações necessárias.
- O pacote não possui absolutamente todas as funcionalidades que os tribunais permitem. Se o usuário tiver interesse em consultar processos em mais tribunais, deverá desenvolver os raspadores.
Por que não um juscraper no R?
O pacote juscraper foi criado em python inicialmente com o propósito de ser usado em aulas de Ciência de Dados no Direito do Insper. Portanto, não houve incentivo nem fôlego para criar uma alternativa em R.
Já existem soluções usando o R para esses raspadores, como os pacotes tjsp e stj, mas a comunidade convergiu para soluções em python, que atualmente são mais populares.
Observação sobre o parâmetro paginas
O parâmetro paginas é 1-based em todos os scrapers. Ao utilizar as funções de download, range(1, n+1) faz o download das páginas 1 até n, ou seja, range(1, 4) baixa as páginas 1, 2 e 3. Onde suportado, passar um inteiro (ex: paginas=3) é equivalente a range(1, 4).
Exemplo de uso:
scraper.cjsg_download(pesquisa="dano moral", paginas=range(1, 6)) # Baixa as páginas 1 a 5
scraper.cjpg_download(pesquisa="contrato", paginas=range(1, 3)) # Baixa as páginas 1 e 2
Instalação em desenvolvimento
Para instalar o pacote em modo desenvolvimento, siga os passos abaixo:
# Clone o repositório (caso ainda não tenha feito)
$ git clone https://github.com/jtrecenti/juscraper.git
$ cd juscraper
# Instale as dependências e o pacote em modo editável
$ uv pip install -e .
Contribuição
Interessado em contribuir? Verifique as diretrizes de contribuição. Por favor, note que este projeto é lançado com um Código de Conduta. Ao contribuir para este projeto, você concorda em obedecer às suas termos.
Licença
juscraper foi criado por Julio Trecenti. Está licenciado sob os termos da licença MIT.
Créditos
juscraper foi criado com cookiecutter e o template py-pkgs-cookiecutter.
Release files for juscraper 0.4.0
For a detailed explanation of source distributions (sdists) and built distributions (wheels), please see the package formats documentation.
Source distribution (sdist)
| File | Size | Uploaded | |
|---|---|---|---|
| juscraper-0.4.0.tar.gz | 270.6 kB | Details |
Built distribution (wheel)
| File | Interpreter | ABI | Platform | Reset |
|---|---|---|---|---|
| juscraper-0.4.0-py3-none-any.whl | Python 3 | none | any | Details |
Total release size: 607.7 kB
Release files / juscraper-0.4.0.tar.gz
| Download URL | juscraper-0.4.0.tar.gz |
|---|---|
| Size | 270.6 kB |
| Tags | Source |
|
SHA-256 checksum How to use checksums |
5f69a52095f4b9cbdf9862f922fcff6cc130e047a9ff2f8337c3d8abaafdea22
|
|
BLAKE2b-256 checksum How to use checksums |
ed536677d4bc04fa6fafb6923d6416ed11c4c5c6729c91b2556dd141448df90c
|
| Upload date | |
|
Uploaded using Trusted Publishing? What is trusted publishing? |
Yes |
| Uploaded via |
twine/7.0.0 CPython/3.13.14
|
Provenance
Provenance describes where a file came from. On PyPI, provenance is shared via attestations, which provide a verifiable record of the build or publishing details. View details, limitations and caveats.
PyPI Publish Attestation
PyPI verified that this artifact, at this checksum, originated from the publisher listed below.
Signed by GitHub Actions, verified by PyPI on Sep 15, 2026.
Transparency logRelease files / juscraper-0.4.0-py3-none-any.whl
| Download URL | juscraper-0.4.0-py3-none-any.whl |
|---|---|
| Size | 337.1 kB |
| Tags | Python 3 |
|
SHA-256 checksum How to use checksums |
e7fb61762f9ab48cc29205874b1fe2f0c95fcea59083b2bf09ad0c6702a79fd0
|
|
BLAKE2b-256 checksum How to use checksums |
2a6a9b937d4d9d839b933e5743ca423aabcaccb064e881316995d9d2852e5eba
|
| Upload date | |
|
Uploaded using Trusted Publishing? What is trusted publishing? |
Yes |
| Uploaded via |
twine/7.0.0 CPython/3.13.14
|
Provenance
Provenance describes where a file came from. On PyPI, provenance is shared via attestations, which provide a verifiable record of the build or publishing details. View details, limitations and caveats.
PyPI Publish Attestation
PyPI verified that this artifact, at this checksum, originated from the publisher listed below.
Signed by GitHub Actions, verified by PyPI on Sep 15, 2026.
Transparency log