Metadata-Version: 2.4
Name: docextractbr
Version: 0.1.0
Summary: SDK Python para a DocExtract API — extração de dados de documentos com IA
Project-URL: Homepage, https://docextract.com.br
Project-URL: Documentation, https://docextract.com.br/docs
Author: DocExtract
License: MIT
License-File: LICENSE
Keywords: ai,api,document,extraction,llm,ocr,pdf,sdk
Classifier: Development Status :: 3 - Alpha
Classifier: Intended Audience :: Developers
Classifier: License :: OSI Approved :: MIT License
Classifier: Programming Language :: Python :: 3
Classifier: Topic :: Software Development :: Libraries
Classifier: Topic :: Text Processing
Requires-Python: >=3.9
Requires-Dist: httpx>=0.24.0
Description-Content-Type: text/markdown

# DocExtract

SDK Python para extração de dados de documentos com IA.

Converte PDFs, imagens e documentos brasileiros em JSON estruturado.

## Instalação

```bash
pip install docextract
```

## Uso rápido

```python
from docextract import DocExtract

doc = DocExtract(api_key="dk_sua_chave")

# Extrair dados de um PDF
result = doc.extract("nota_fiscal.pdf")
print(result["fields"]["emitente_cnpj"])
print(result["confidence"])  # 0.98

# Especificar tipo de documento
result = doc.extract("cnh.jpg", document_type="cnh")
print(result["fields"]["nome"])
print(result["fields"]["cpf"])

# Auto-detect
result = doc.extract("documento.pdf", document_type="auto")
print(result["document_type"])  # "nfe", "cnh", etc.
```

## Tipos de documentos suportados

| Tipo | Código |
|------|--------|
| CNH | `cnh` |
| RG | `rg` |
| CPF | `cpf` |
| NF-e | `nfe` |
| NFS-e | `nfse` |
| Boleto | `boleto` |
| Contrato Social | `contrato_social` |
| Comprovante de Residência | `comprovante_residencia` |
| Holerite | `comprovante_renda` |
| Detecção automática | `auto` |

## BYOK (Bring Your Own Key)

Configure sua própria API key de IA no painel, ou passe inline:

```python
result = doc.extract(
    "documento.pdf",
    llm_provider="gemini",
    llm_api_key="sua_gemini_key",
    llm_model="gemini-2.5-flash",
)
```

## Extrair de bytes em memória

```python
with open("doc.pdf", "rb") as f:
    result = doc.extract_bytes(f.read(), "doc.pdf", document_type="nfe")
```

## Links

- Documentação: https://docextract.com.br/docs
- Painel: https://docextract.com.br
