Gerar extração de dados
Pessoas indígenas de 10 anos ou mais de idade, ocupadas na semana de referência, que, no trabalho principal, trabalhavam fora do domicílio ou propriedade, por tempo habitual de deslocamento do domicílio para o trabalho principal, meio de transporte em que passa mais tempo para chegar ao local de trabalho, nível de instrução e grupos de idade
Já tem uma URL do SIDRA? Cole aqui para carregar a seleção.
URL de requisição da API SIDRA (/values).
https://apisidra.ibge.gov.br/values/t/10338/n1/all/v/all/p/all/c537/all/h/y/f/a/d/m
Sem dependências Quantilica — apenas requests e pandas.
# Dados da Tabela 10338 do IBGE SIDRA (https://apisidra.ibge.gov.br)
# Requisitos: pip install requests pandas
import pandas as pd
import requests
url = "https://apisidra.ibge.gov.br/values/t/10338/n1/all/v/all/p/all/c537/all/h/y/f/a/d/m"
resposta = requests.get(url, timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pd.DataFrame(linhas[1:]).rename(columns=linhas[0])
print(df.head())
Usa o sidra-fetcher
(construtor de URL tipado) + httpx + polars.
# Dados da Tabela 10338 do IBGE SIDRA via sidra-fetcher
# https://github.com/Quantilica/sidra-fetcher
# Requisitos: pip install httpx polars
# pip install "sidra-fetcher @ git+https://github.com/Quantilica/sidra-fetcher.git"
import httpx
import polars as pl
from sidra_fetcher.sidra import Parametro
parametro = Parametro(
agregado="10338",
territorios={"1": ["all"]},
variaveis=["all"],
periodos=["all"],
classificacoes={"537": ["all"]},
)
resposta = httpx.get(parametro.url(), timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pl.DataFrame(linhas[1:]).rename(linhas[0])
print(df.head())
Bloco [[tabelas]] para um catálogo de pipelines do sidra-sql.
[[tabelas]]
tabela_sidra = "10338"
variables = ["allxp"]
territories = {1 = []}
classifications = {537 = ["allxt"], 1568 = [], 58 = [], 2088 = []}
# c1568 (Nível de instrução) não tem categoria "Total"; [] baixa todas as categorias.
# c58 (Grupo de idade) não tem categoria "Total"; [] baixa todas as categorias.
# c2088 (Meio de transporte em que passa mais tempo para chegar ao local de trabalho) não tem categoria "Total"; [] baixa todas as categorias.
Cole o bloco acima em um fetch.toml existente do seu plugin sidra-sql,
ou instale e rode um pipeline novo já configurado para esta tabela:
sidra-sql plugin install <url-do-seu-repo> --alias meu_plugin
sidra-sql run meu_plugin tabela_10338
sidra-sql export meu_plugin tabela_10338
ibge_sidra) já carregado via sidra-sql run para esta tabela.
Consulta filtrada pela seleção acima.
-- Tabela 10338 — Pessoas indígenas de 10 anos ou mais de idade, ocupadas na semana de referência, que, no trabalho principal, trabalhavam fora do domicílio ou propriedade, por tempo habitual de deslocamento do domicílio para o trabalho principal, meio de transporte em que passa mais tempo para chegar ao local de trabalho, nível de instrução e grupos de idade
-- Consulta ao banco carregado pelo sidra-sql (schema ibge_sidra)
-- https://github.com/Quantilica/sidra-sql
-- Pressupõe `sidra-sql run` já executado para a tabela 10338.
SELECT
p.codigo AS periodo,
p.ano,
l.nc AS nivel_territorial,
l.d1c AS localidade_codigo,
l.d1n AS localidade_nome,
dim.d2c AS variavel_codigo,
dim.d2n AS variavel,
dim.mn AS unidade,
dim.d4c AS tempo_habitual_de_deslocamento_do_domici_codigo,
dim.d4n AS tempo_habitual_de_deslocamento_do_domici,
dim.d5c AS nivel_de_instrucao_codigo,
dim.d5n AS nivel_de_instrucao,
dim.d6c AS grupo_de_idade_codigo,
dim.d6n AS grupo_de_idade,
dim.d7c AS meio_de_transporte_em_que_passa_mais_tem_codigo,
dim.d7n AS meio_de_transporte_em_que_passa_mais_tem,
CASE WHEN d.v ~ '^-?[0-9]' THEN d.v::numeric END AS valor
FROM ibge_sidra.dados AS d
JOIN ibge_sidra.periodo AS p ON d.periodo_id = p.id
JOIN ibge_sidra.dimensao AS dim ON d.dimensao_id = dim.id
JOIN ibge_sidra.localidade AS l ON d.localidade_id = l.id
WHERE d.tabela_sidra_id = '10338'
AND d.ativo = TRUE
AND (l.nc = '1')
ORDER BY p.codigo, l.d1c;