Gerar extração de dados
Pessoal ocupado em estabelecimentos agropecuários em 31/12, total e de 14 anos e mais, sem laço de parentesco com o produtor por principais aspectos em relação ao pessoal ocupado, condição do produtor em relação às terras, grupos de pessoal ocupado, grupos de atividade econômica e classificações de médio produtor
Já tem uma URL do SIDRA? Cole aqui para carregar a seleção.
URL de requisição da API SIDRA (/values).
https://apisidra.ibge.gov.br/values/t/4265/n1/all/v/all/p/all/c12576/all/h/y/f/a/d/m
Sem dependências Quantilica — apenas requests e pandas.
# Dados da Tabela 4265 do IBGE SIDRA (https://apisidra.ibge.gov.br)
# Requisitos: pip install requests pandas
import pandas as pd
import requests
url = "https://apisidra.ibge.gov.br/values/t/4265/n1/all/v/all/p/all/c12576/all/h/y/f/a/d/m"
resposta = requests.get(url, timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pd.DataFrame(linhas[1:]).rename(columns=linhas[0])
print(df.head())
Usa o sidra-fetcher
(construtor de URL tipado) + httpx + polars.
# Dados da Tabela 4265 do IBGE SIDRA via sidra-fetcher
# https://github.com/Quantilica/sidra-fetcher
# Requisitos: pip install httpx polars
# pip install "sidra-fetcher @ git+https://github.com/Quantilica/sidra-fetcher.git"
import httpx
import polars as pl
from sidra_fetcher.sidra import Parametro
parametro = Parametro(
agregado="4265",
territorios={"1": ["all"]},
variaveis=["all"],
periodos=["all"],
classificacoes={"12576": ["all"]},
)
resposta = httpx.get(parametro.url(), timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pl.DataFrame(linhas[1:]).rename(linhas[0])
print(df.head())
Bloco [[tabelas]] para um catálogo de pipelines do sidra-sql.
[[tabelas]]
tabela_sidra = "4265"
variables = ["allxp"]
territories = {1 = []}
classifications = {12576 = ["allxt"], 218 = ["0"], 11574 = ["0"], 12517 = ["0"], 637 = ["0"]}
Cole o bloco acima em um fetch.toml existente do seu plugin sidra-sql,
ou instale e rode um pipeline novo já configurado para esta tabela:
sidra-sql plugin install <url-do-seu-repo> --alias meu_plugin
sidra-sql run meu_plugin tabela_4265
sidra-sql export meu_plugin tabela_4265
ibge_sidra) já carregado via sidra-sql run para esta tabela.
Consulta filtrada pela seleção acima.
-- Tabela 4265 — Pessoal ocupado em estabelecimentos agropecuários em 31/12, total e de 14 anos e mais, sem laço de parentesco com o produtor por principais aspectos em relação ao pessoal ocupado, condição do produtor em relação às terras, grupos de pessoal ocupado, grupos de atividade econômica e classificações de médio produtor
-- Consulta ao banco carregado pelo sidra-sql (schema ibge_sidra)
-- https://github.com/Quantilica/sidra-sql
-- Pressupõe `sidra-sql run` já executado para a tabela 4265.
SELECT
p.codigo AS periodo,
p.ano,
l.nc AS nivel_territorial,
l.d1c AS localidade_codigo,
l.d1n AS localidade_nome,
dim.d2c AS variavel_codigo,
dim.d2n AS variavel,
dim.mn AS unidade,
dim.d4c AS principais_aspectos_em_relacao_ao_pessoa_codigo,
dim.d4n AS principais_aspectos_em_relacao_ao_pessoa,
dim.d5c AS condicao_do_produtor_em_relacao_as_terra_codigo,
dim.d5n AS condicao_do_produtor_em_relacao_as_terra,
dim.d6c AS grupos_de_pessoal_ocupado_codigo,
dim.d6n AS grupos_de_pessoal_ocupado,
dim.d7c AS grupos_de_atividade_economica_codigo,
dim.d7n AS grupos_de_atividade_economica,
dim.d8c AS classificacao_de_medio_produtor_codigo,
dim.d8n AS classificacao_de_medio_produtor,
CASE WHEN d.v ~ '^-?[0-9]' THEN d.v::numeric END AS valor
FROM ibge_sidra.dados AS d
JOIN ibge_sidra.periodo AS p ON d.periodo_id = p.id
JOIN ibge_sidra.dimensao AS dim ON d.dimensao_id = dim.id
JOIN ibge_sidra.localidade AS l ON d.localidade_id = l.id
WHERE d.tabela_sidra_id = '4265'
AND d.ativo = TRUE
AND (l.nc = '1')
ORDER BY p.codigo, l.d1c;