Gerar extração de dados
Receita bruta de serviços das agências de publicidade com 10 ou mais pessoas ocupadas, que informaram pelo menos um segmento de atuação de seus clientes, por segmento de atuação, idade média da agência, faixa de pessoal ocupado e característica da agência
Já tem uma URL do SIDRA? Cole aqui para carregar a seleção.
URL de requisição da API SIDRA (/values).
https://apisidra.ibge.gov.br/values/t/3251/n1/all/v/all/p/all/c445/all/h/y/f/a/d/m
Sem dependências Quantilica — apenas requests e pandas.
# Dados da Tabela 3251 do IBGE SIDRA (https://apisidra.ibge.gov.br)
# Requisitos: pip install requests pandas
import pandas as pd
import requests
url = "https://apisidra.ibge.gov.br/values/t/3251/n1/all/v/all/p/all/c445/all/h/y/f/a/d/m"
resposta = requests.get(url, timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pd.DataFrame(linhas[1:]).rename(columns=linhas[0])
print(df.head())
Usa o sidra-fetcher
(construtor de URL tipado) + httpx + polars.
# Dados da Tabela 3251 do IBGE SIDRA via sidra-fetcher
# https://github.com/Quantilica/sidra-fetcher
# Requisitos: pip install httpx polars
# pip install "sidra-fetcher @ git+https://github.com/Quantilica/sidra-fetcher.git"
import httpx
import polars as pl
from sidra_fetcher.sidra import Parametro
parametro = Parametro(
agregado="3251",
territorios={"1": ["all"]},
variaveis=["all"],
periodos=["all"],
classificacoes={"445": ["all"]},
)
resposta = httpx.get(parametro.url(), timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
# A primeira linha traz os nomes amigáveis das colunas (/h/y)
df = pl.DataFrame(linhas[1:]).rename(linhas[0])
print(df.head())
Bloco [[tabelas]] para um catálogo de pipelines do sidra-sql.
[[tabelas]]
tabela_sidra = "3251"
variables = ["allxp"]
territories = {1 = []}
classifications = {445 = ["allxt"], 440 = ["0"], 319 = ["0"], 442 = []}
# c442 (Característica da agência de publicidade) não tem categoria "Total"; [] baixa todas as categorias.
Cole o bloco acima em um fetch.toml existente do seu plugin sidra-sql,
ou instale e rode um pipeline novo já configurado para esta tabela:
sidra-sql plugin install <url-do-seu-repo> --alias meu_plugin
sidra-sql run meu_plugin tabela_3251
sidra-sql export meu_plugin tabela_3251
ibge_sidra) já carregado via sidra-sql run para esta tabela.
Consulta filtrada pela seleção acima.
-- Tabela 3251 — Receita bruta de serviços das agências de publicidade com 10 ou mais pessoas ocupadas, que informaram pelo menos um segmento de atuação de seus clientes, por segmento de atuação, idade média da agência, faixa de pessoal ocupado e característica da agência
-- Consulta ao banco carregado pelo sidra-sql (schema ibge_sidra)
-- https://github.com/Quantilica/sidra-sql
-- Pressupõe `sidra-sql run` já executado para a tabela 3251.
SELECT
p.codigo AS periodo,
p.ano,
l.nc AS nivel_territorial,
l.d1c AS localidade_codigo,
l.d1n AS localidade_nome,
dim.d2c AS variavel_codigo,
dim.d2n AS variavel,
dim.mn AS unidade,
dim.d4c AS segmento_de_atuacao_da_agencia_de_public_codigo,
dim.d4n AS segmento_de_atuacao_da_agencia_de_public,
dim.d5c AS idade_media_da_agencia_de_publicidade_codigo,
dim.d5n AS idade_media_da_agencia_de_publicidade,
dim.d6c AS faixas_de_pessoal_ocupado_codigo,
dim.d6n AS faixas_de_pessoal_ocupado,
dim.d7c AS caracteristica_da_agencia_de_publicidade_codigo,
dim.d7n AS caracteristica_da_agencia_de_publicidade,
CASE WHEN d.v ~ '^-?[0-9]' THEN d.v::numeric END AS valor
FROM ibge_sidra.dados AS d
JOIN ibge_sidra.periodo AS p ON d.periodo_id = p.id
JOIN ibge_sidra.dimensao AS dim ON d.dimensao_id = dim.id
JOIN ibge_sidra.localidade AS l ON d.localidade_id = l.id
WHERE d.tabela_sidra_id = '3251'
AND d.ativo = TRUE
AND (l.nc = '1')
ORDER BY p.codigo, l.d1c;