Gerar extração de dados
Número de estabelecimentos e Área dos estabelecimentos agropecuários por condição legal do produtor em relação às terras, sexo do dirigente, condição do produtor em relação às terras, direção do estabelecimento, classe de idade do produtor e nível de instrução do produtor
Já tem uma URL do SIDRA? Cole aqui para carregar a seleção.
URL de requisição da API SIDRA (/values).
https://apisidra.ibge.gov.br/values/t/1014/n1/all/v/all/p/all/c12566/all/h/y/f/a/d/m
Sem dependências Quantilica — apenas requests e pandas.
# Dados da Tabela 1014 do IBGE SIDRA (https://apisidra.ibge.gov.br)
# Requisitos: pip install requests pandas
import pandas as pd
import requests
url = "https://apisidra.ibge.gov.br/values/t/1014/n1/all/v/all/p/all/c12566/all/h/y/f/a/d/m"
resposta = requests.get(url, timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pd.DataFrame(linhas[1:]).rename(columns=linhas[0])
print(df.head())
Usa o sidra-fetcher
(construtor de URL tipado) + httpx + polars.
# Dados da Tabela 1014 do IBGE SIDRA via sidra-fetcher
# https://github.com/Quantilica/sidra-fetcher
# Requisitos: pip install httpx polars
# pip install "sidra-fetcher @ git+https://github.com/Quantilica/sidra-fetcher.git"
import httpx
import polars as pl
from sidra_fetcher.sidra import Parametro
parametro = Parametro(
agregado="1014",
territorios={"1": ["all"]},
variaveis=["all"],
periodos=["all"],
classificacoes={"12566": ["all"]},
)
resposta = httpx.get(parametro.url(), timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pl.DataFrame(linhas[1:]).rename(linhas[0])
print(df.head())
Bloco [[tabelas]] para um catálogo de pipelines do sidra-sql.
[[tabelas]]
tabela_sidra = "1014"
variables = ["allxp"]
territories = {1 = []}
classifications = {12559 = ["0"], 12566 = ["allxt"], 218 = ["0"], 12556 = ["0"], 12771 = ["0"], 12772 = ["0"]}
Cole o bloco acima em um fetch.toml existente do seu plugin sidra-sql,
ou instale e rode um pipeline novo já configurado para esta tabela:
sidra-sql plugin install <url-do-seu-repo> --alias meu_plugin
sidra-sql run meu_plugin tabela_1014
sidra-sql export meu_plugin tabela_1014
ibge_sidra) já carregado via sidra-sql run para esta tabela.
Consulta filtrada pela seleção acima.
-- Tabela 1014 — Número de estabelecimentos e Área dos estabelecimentos agropecuários por condição legal do produtor em relação às terras, sexo do dirigente, condição do produtor em relação às terras, direção do estabelecimento, classe de idade do produtor e nível de instrução do produtor
-- Consulta ao banco carregado pelo sidra-sql (schema ibge_sidra)
-- https://github.com/Quantilica/sidra-sql
-- Pressupõe `sidra-sql run` já executado para a tabela 1014.
SELECT
p.codigo AS periodo,
p.ano,
l.nc AS nivel_territorial,
l.d1c AS localidade_codigo,
l.d1n AS localidade_nome,
dim.d2c AS variavel_codigo,
dim.d2n AS variavel,
dim.mn AS unidade,
dim.d4c AS condicao_legal_do_produtor_codigo,
dim.d4n AS condicao_legal_do_produtor,
dim.d5c AS sexo_da_pessoa_que_dirige_o_estabelecime_codigo,
dim.d5n AS sexo_da_pessoa_que_dirige_o_estabelecime,
dim.d6c AS condicao_do_produtor_em_relacao_as_terra_codigo,
dim.d6n AS condicao_do_produtor_em_relacao_as_terra,
dim.d7c AS direcao_do_estabelecimento_codigo,
dim.d7n AS direcao_do_estabelecimento,
dim.d8c AS classe_de_idade_do_produtor_codigo,
dim.d8n AS classe_de_idade_do_produtor,
dim.d9c AS nivel_de_instrucao_do_produtor_codigo,
dim.d9n AS nivel_de_instrucao_do_produtor,
CASE WHEN d.v ~ '^-?[0-9]' THEN d.v::numeric END AS valor
FROM ibge_sidra.dados AS d
JOIN ibge_sidra.periodo AS p ON d.periodo_id = p.id
JOIN ibge_sidra.dimensao AS dim ON d.dimensao_id = dim.id
JOIN ibge_sidra.localidade AS l ON d.localidade_id = l.id
WHERE d.tabela_sidra_id = '1014'
AND d.ativo = TRUE
AND (l.nc = '1')
ORDER BY p.codigo, l.d1c;