SDK Python para a DocExtract API — extração de dados de documentos com IA
Project description
DocExtract
SDK Python para extração de dados de documentos com IA.
Converte PDFs, imagens e documentos brasileiros em JSON estruturado.
Instalação
pip install docextract
Uso rápido
from docextract import DocExtract
doc = DocExtract(api_key="dk_sua_chave")
# Extrair dados de um PDF
result = doc.extract("nota_fiscal.pdf")
print(result["fields"]["emitente_cnpj"])
print(result["confidence"]) # 0.98
# Especificar tipo de documento
result = doc.extract("cnh.jpg", document_type="cnh")
print(result["fields"]["nome"])
print(result["fields"]["cpf"])
# Auto-detect
result = doc.extract("documento.pdf", document_type="auto")
print(result["document_type"]) # "nfe", "cnh", etc.
Tipos de documentos suportados
| Tipo | Código |
|---|---|
| CNH | cnh |
| RG | rg |
| CPF | cpf |
| NF-e | nfe |
| NFS-e | nfse |
| Boleto | boleto |
| Contrato Social | contrato_social |
| Comprovante de Residência | comprovante_residencia |
| Holerite | comprovante_renda |
| Detecção automática | auto |
BYOK (Bring Your Own Key)
Configure sua própria API key de IA no painel, ou passe inline:
result = doc.extract(
"documento.pdf",
llm_provider="gemini",
llm_api_key="sua_gemini_key",
llm_model="gemini-2.5-flash",
)
Extrair de bytes em memória
with open("doc.pdf", "rb") as f:
result = doc.extract_bytes(f.read(), "doc.pdf", document_type="nfe")
Links
- Documentação: https://docextract.com.br/docs
- Painel: https://docextract.com.br
Project details
Release history Release notifications | RSS feed
Download files
Download the file for your platform. If you're not sure which to choose, learn more about installing packages.
Source Distribution
docextractbr-0.1.0.tar.gz
(3.3 kB
view details)
Built Distribution
Filter files by name, interpreter, ABI, and platform.
If you're not sure about the file name format, learn more about wheel file names.
Copy a direct link to the current filters
File details
Details for the file docextractbr-0.1.0.tar.gz.
File metadata
- Download URL: docextractbr-0.1.0.tar.gz
- Upload date:
- Size: 3.3 kB
- Tags: Source
- Uploaded using Trusted Publishing? No
- Uploaded via: twine/6.2.0 CPython/3.13.7
File hashes
| Algorithm | Hash digest | |
|---|---|---|
| SHA256 |
ecf3cb047f620c6bf5b79f1e77cb9ab6339740d78c3dbc63c2e4a3d021c77826
|
|
| MD5 |
2f177aeb42c7a84ce5a0c813a10b7cd3
|
|
| BLAKE2b-256 |
09840209b64b9772b2cd0e08bd849e69267893995f16ad11224ffde0e692e81a
|
File details
Details for the file docextractbr-0.1.0-py3-none-any.whl.
File metadata
- Download URL: docextractbr-0.1.0-py3-none-any.whl
- Upload date:
- Size: 4.2 kB
- Tags: Python 3
- Uploaded using Trusted Publishing? No
- Uploaded via: twine/6.2.0 CPython/3.13.7
File hashes
| Algorithm | Hash digest | |
|---|---|---|
| SHA256 |
dfa7710a49af3854a1e5592b48cc635bde9191c80216712ba7a8886bb9da9028
|
|
| MD5 |
248de325cdc9eabf6d3a0572a0355499
|
|
| BLAKE2b-256 |
cd8f6a2f3fa70fd379480524b2cc03909055b4ad935b93c4a72b4b7619c2c1ae
|