Gerar extração de dados
Número de estabelecimentos agropecuários, por tipo de fonte de energia elétrica, sexo do dirigente, orientação técnica, origem da orientação técnica, nível de instrução da pessoa que dirige o estabelecimento e grupos de atividade econômica
Já tem uma URL do SIDRA? Cole aqui para carregar a seleção.
URL de requisição da API SIDRA (/values).
https://apisidra.ibge.gov.br/values/t/3346/n1/all/v/all/p/all/c12517/all/h/y/f/a/d/m
Sem dependências Quantilica — apenas requests e pandas.
# Dados da Tabela 3346 do IBGE SIDRA (https://apisidra.ibge.gov.br)
# Requisitos: pip install requests pandas
import pandas as pd
import requests
url = "https://apisidra.ibge.gov.br/values/t/3346/n1/all/v/all/p/all/c12517/all/h/y/f/a/d/m"
resposta = requests.get(url, timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pd.DataFrame(linhas[1:]).rename(columns=linhas[0])
print(df.head())
Usa o sidra-fetcher
(construtor de URL tipado) + httpx + polars.
# Dados da Tabela 3346 do IBGE SIDRA via sidra-fetcher
# https://github.com/Quantilica/sidra-fetcher
# Requisitos: pip install httpx polars
# pip install "sidra-fetcher @ git+https://github.com/Quantilica/sidra-fetcher.git"
import httpx
import polars as pl
from sidra_fetcher.sidra import Parametro
parametro = Parametro(
agregado="3346",
territorios={"1": ["all"]},
variaveis=["all"],
periodos=["all"],
classificacoes={"12517": ["all"]},
)
resposta = httpx.get(parametro.url(), timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pl.DataFrame(linhas[1:]).rename(linhas[0])
print(df.head())
Bloco [[tabelas]] para um catálogo de pipelines do sidra-sql.
[[tabelas]]
tabela_sidra = "3346"
variables = ["allxp"]
territories = {1 = []}
classifications = {12581 = ["0"], 12566 = ["0"], 12548 = ["0"], 12567 = ["0"], 12552 = ["0"], 12517 = ["allxt"]}
Cole o bloco acima em um fetch.toml existente do seu plugin sidra-sql,
ou instale e rode um pipeline novo já configurado para esta tabela:
sidra-sql plugin install <url-do-seu-repo> --alias meu_plugin
sidra-sql run meu_plugin tabela_3346
sidra-sql export meu_plugin tabela_3346
ibge_sidra) já carregado via sidra-sql run para esta tabela.
Consulta filtrada pela seleção acima.
-- Tabela 3346 — Número de estabelecimentos agropecuários, por tipo de fonte de energia elétrica, sexo do dirigente, orientação técnica, origem da orientação técnica, nível de instrução da pessoa que dirige o estabelecimento e grupos de atividade econômica
-- Consulta ao banco carregado pelo sidra-sql (schema ibge_sidra)
-- https://github.com/Quantilica/sidra-sql
-- Pressupõe `sidra-sql run` já executado para a tabela 3346.
SELECT
p.codigo AS periodo,
p.ano,
l.nc AS nivel_territorial,
l.d1c AS localidade_codigo,
l.d1n AS localidade_nome,
dim.d2c AS variavel_codigo,
dim.d2n AS variavel,
dim.mn AS unidade,
dim.d4c AS tipo_de_fonte_de_energia_eletrica_codigo,
dim.d4n AS tipo_de_fonte_de_energia_eletrica,
dim.d5c AS sexo_da_pessoa_que_dirige_o_estabelecime_codigo,
dim.d5n AS sexo_da_pessoa_que_dirige_o_estabelecime,
dim.d6c AS orientacao_tecnica_codigo,
dim.d6n AS orientacao_tecnica,
dim.d7c AS origem_da_orientacao_tecnica_recebida_codigo,
dim.d7n AS origem_da_orientacao_tecnica_recebida,
dim.d8c AS nivel_de_instrucao_da_pessoa_que_dirige__codigo,
dim.d8n AS nivel_de_instrucao_da_pessoa_que_dirige_,
dim.d9c AS grupos_de_atividade_economica_codigo,
dim.d9n AS grupos_de_atividade_economica,
CASE WHEN d.v ~ '^-?[0-9]' THEN d.v::numeric END AS valor
FROM ibge_sidra.dados AS d
JOIN ibge_sidra.periodo AS p ON d.periodo_id = p.id
JOIN ibge_sidra.dimensao AS dim ON d.dimensao_id = dim.id
JOIN ibge_sidra.localidade AS l ON d.localidade_id = l.id
WHERE d.tabela_sidra_id = '3346'
AND d.ativo = TRUE
AND (l.nc = '1')
ORDER BY p.codigo, l.d1c;