Comece em 5 minutos¶
Cinco caminhos prontos para baixar e analisar um dataset público real, do zero. Escolha o domínio mais próximo do seu trabalho — todos seguem o mesmo padrão.
Pré-requisitos¶
- Python 3.12+
- uv para gerenciar ambientes (recomendado).
# Instala a CLI unificada
uv tool install quantilica-cli
# Instala o fetcher desejado sob demanda
quantilica install comex
Para usar os fetchers como bibliotecas Python dentro do seu projeto:
uv add comex-fetcher --index https://index.quantilica.com/simple/
Baixa os metadados completos do IPCA-15 (agregado 1705) e mostra a estrutura: períodos disponíveis, localidades cobertas, variáveis.
uv add sidra-fetcher --index https://index.quantilica.com/simple/
from sidra_fetcher.fetcher import SidraClient
with SidraClient() as client:
agregado = client.get_agregado(1705) # IPCA-15
print(f"Agregado: {agregado.nome}")
print(f"Periodicidade: {agregado.periodicidade.frequencia}")
print(f"Períodos disponíveis: {len(agregado.periodos)}")
print(f"Localidades cobertas: {len(agregado.localidades)}")
ultimos = agregado.periodos[-5:]
for p in ultimos:
print(f" {p.id} ({p.data_inicio} → {p.data_fim})")
Saída esperada: nome do agregado, frequência mensal, ~84 períodos, dezenas de localidades, e os últimos 5 períodos com data de início e fim já parseados.
Próximos passos:
Baixa o histórico completo de taxas e preços do Tesouro Direto via API CKAN, lê com Polars e plota a yield curve por tipo de título.
uv add "tesouro-direto-fetcher[analysis]" --index https://index.quantilica.com/simple/
import asyncio
from pathlib import Path
from tesouro_direto_fetcher import downloader, reader, plot
dest = Path("./dados")
asyncio.run(
downloader.download(
dest_dir=dest,
dataset_id="taxas-dos-titulos-ofertados-pelo-tesouro-direto",
)
)
csv = next(dest.glob("taxas-*.csv"))
df = reader.read_prices(csv)
chart = plot.plot_prices(df, bond_type="Tesouro Selic", variable="buy_yield")
chart.save("selic.html")
Saída esperada: CSV baixado em ./dados/, DataFrame com colunas tipadas, e um arquivo selic.html com a curva pronta para abrir no navegador.
Próximos passos:
Baixa os microdados do SIH-RD (Internações Hospitalares) para São Paulo nos últimos 3 anos. Sem dependências externas — datasus-fetcher roda em Python puro.
quantilica install datasus
datasus-fetcher sync sih-rd \
-o ./dados \
--start 2022-01 \
--end 2024-12 \
--regions sp \
--threads 4
Saída esperada: dezenas de arquivos .dbc em ./dados/sih-rd/, com retry automático, verificação de integridade e versionamento por data.
Para abrir os .dbc, use o leitor pyreaddbc ou a conversão via quantilica-analytics.
Próximos passos:
Baixa um intervalo de anos do BDMEP em paralelo, com encoding e cabeçalhos já tratados, e exporta direto em Parquet.
quantilica install inmet
inmet-fetcher sync 2020:2024 -o ./dados --workers 4
inmet-fetcher read -o ./dados --uf SP,RJ --save-as sudeste.parquet
Saída esperada: ZIPs anuais baixados, dados unificados em sudeste.parquet com colunas em snake_case, datetime nativo e valores nulos limpos.
Próximos passos:
Baixa séries macroeconômicas do SGS/BCB — câmbio USD/BRL diário e Selic mensal — como JSONs com manifesto de proveniência.
quantilica install bcb-sgs
# Câmbio USD/BRL (série 1, diária — varredura retroativa ano a ano)
quantilica bcb-sgs series sync 1 -f D -o ./dados
# Selic mensal (série 11)
quantilica bcb-sgs series sync 11 -f M -o ./dados
Saída esperada: JSONs por série em ./dados/, cada um acompanhado de manifesto SHA-256. Descubra outros IDs com quantilica bcb-sgs series search "<termo>".
Próximos passos:
Outras fontes¶
Os cinco caminhos acima são portas de entrada. O ecossistema cobre ainda comércio exterior (Comex), mercado de trabalho (CAGED/RAIS), aviação civil (ANAC), petróleo e combustíveis (ANP), educação (INEP) e empresas (RFB-CNPJ) — todos instaláveis com quantilica install <fonte>.
O que vem junto, de graça¶
Toda ferramenta Quantilica entrega o mesmo conjunto de garantias — você não precisa pedir:
- Retry automático com backoff exponencial em qualquer erro de rede.
- Proveniência SHA-256 em manifestos
.manifest.jsonao lado de cada arquivo baixado. - Saída tipada em Parquet (via
quantilica-analytics) ou dataclasses Python. - Logging estruturado consistente em toda a stack.
- Idempotência — rodar duas vezes não baixa duas vezes.
Esses comportamentos vêm do pacote de fundação quantilica-core. Você nunca precisa configurar isso à mão.
Próximos passos¶
- Princípios de Design — entenda por que o sistema tem essa forma.
- Cookbook — receitas que combinam múltiplos domínios.
- Arquitetura — como
-fetcher,-sqle-pipelinesse conectam.