Gerar extração de dados
IPCA dessazonalizado - Variação mensal, acumulada no ano e peso mensal, para o índice geral, grupos, subgrupos, itens e subitens de produtos e serviços (de janeiro/2012 até dezembro/2019)
Já tem uma URL do SIDRA? Cole aqui para carregar a seleção.
URL de requisição da API SIDRA (/values).
https://apisidra.ibge.gov.br/values/t/1420/n1/all/v/all/p/all/c315/all/h/y/f/a/d/m
Sem dependências Quantilica — apenas requests e pandas.
# Dados da Tabela 1420 do IBGE SIDRA (https://apisidra.ibge.gov.br)
# Requisitos: pip install requests pandas
# A seleção completa excede o limite de 100.000 valores por requisição da API;
# baixamos um período por vez e concatenamos.
import pandas as pd
import requests
periodos = [
"201201", "201202", "201203", "201204", "201205", "201206", "201207", "201208",
"201209", "201210", "201211", "201212", "201301", "201302", "201303", "201304",
"201305", "201306", "201307", "201308", "201309", "201310", "201311", "201312",
"201401", "201402", "201403", "201404", "201405", "201406", "201407", "201408",
"201409", "201410", "201411", "201412", "201501", "201502", "201503", "201504",
"201505", "201506", "201507", "201508", "201509", "201510", "201511", "201512",
"201601", "201602", "201603", "201604", "201605", "201606", "201607", "201608",
"201609", "201610", "201611", "201612", "201701", "201702", "201703", "201704",
"201705", "201706", "201707", "201708", "201709", "201710", "201711", "201712",
"201801", "201802", "201803", "201804", "201805", "201806", "201807", "201808",
"201809", "201810", "201811", "201812", "201901", "201902", "201903", "201904",
"201905", "201906", "201907", "201908", "201909", "201910", "201911", "201912",
]
quadros = []
for periodo in periodos:
url = f"https://apisidra.ibge.gov.br/values/t/1420/n1/all/v/all/p/{periodo}/c315/all/h/y/f/a/d/m"
resposta = requests.get(url, timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
quadros.append(pd.DataFrame(linhas[1:]).rename(columns=linhas[0]))
df = pd.concat(quadros, ignore_index=True)
print(df.head())
Usa o sidra-fetcher
(construtor de URL tipado) + httpx + polars.
# Dados da Tabela 1420 do IBGE SIDRA via sidra-fetcher
# https://github.com/Quantilica/sidra-fetcher
# Requisitos: pip install httpx polars
# pip install "sidra-fetcher @ git+https://github.com/Quantilica/sidra-fetcher.git"
# A seleção completa excede o limite de 100.000 valores por requisição da API;
# baixamos um período por vez e concatenamos.
import httpx
import polars as pl
from sidra_fetcher.sidra import Parametro
parametro = Parametro(
agregado="1420",
territorios={"1": ["all"]},
variaveis=["all"],
periodos=["all"],
classificacoes={"315": ["all"]},
)
periodos = [
"201201", "201202", "201203", "201204", "201205", "201206", "201207", "201208",
"201209", "201210", "201211", "201212", "201301", "201302", "201303", "201304",
"201305", "201306", "201307", "201308", "201309", "201310", "201311", "201312",
"201401", "201402", "201403", "201404", "201405", "201406", "201407", "201408",
"201409", "201410", "201411", "201412", "201501", "201502", "201503", "201504",
"201505", "201506", "201507", "201508", "201509", "201510", "201511", "201512",
"201601", "201602", "201603", "201604", "201605", "201606", "201607", "201608",
"201609", "201610", "201611", "201612", "201701", "201702", "201703", "201704",
"201705", "201706", "201707", "201708", "201709", "201710", "201711", "201712",
"201801", "201802", "201803", "201804", "201805", "201806", "201807", "201808",
"201809", "201810", "201811", "201812", "201901", "201902", "201903", "201904",
"201905", "201906", "201907", "201908", "201909", "201910", "201911", "201912",
]
quadros = []
for periodo in periodos:
p = parametro.assign("periodos", [periodo])
resposta = httpx.get(p.url(), timeout=120)
resposta.raise_for_status()
linhas = resposta.json()
quadros.append(pl.DataFrame(linhas[1:]).rename(linhas[0]))
df = pl.concat(quadros)
print(df.head())
Bloco [[tabelas]] para um catálogo de pipelines do sidra-sql.
[[tabelas]]
tabela_sidra = "1420"
variables = ["allxp"]
territories = {1 = []}
classifications = {315 = ["allxt"]}
Cole o bloco acima em um fetch.toml existente do seu plugin sidra-sql,
ou instale e rode um pipeline novo já configurado para esta tabela:
sidra-sql plugin install <url-do-seu-repo> --alias meu_plugin
sidra-sql run meu_plugin tabela_1420
sidra-sql export meu_plugin tabela_1420
ibge_sidra) já carregado via sidra-sql run para esta tabela.
Consulta filtrada pela seleção acima.
-- Tabela 1420 — IPCA dessazonalizado - Variação mensal, acumulada no ano e peso mensal, para o índice geral, grupos, subgrupos, itens e subitens de produtos e serviços (de janeiro/2012 até dezembro/2019)
-- Consulta ao banco carregado pelo sidra-sql (schema ibge_sidra)
-- https://github.com/Quantilica/sidra-sql
-- Pressupõe `sidra-sql run` já executado para a tabela 1420.
SELECT
p.codigo AS periodo,
p.ano,
l.nc AS nivel_territorial,
l.d1c AS localidade_codigo,
l.d1n AS localidade_nome,
dim.d2c AS variavel_codigo,
dim.d2n AS variavel,
dim.mn AS unidade,
dim.d4c AS geral_grupo_subgrupo_item_e_subitem_codigo,
dim.d4n AS geral_grupo_subgrupo_item_e_subitem,
CASE WHEN d.v ~ '^-?[0-9]' THEN d.v::numeric END AS valor
FROM ibge_sidra.dados AS d
JOIN ibge_sidra.periodo AS p ON d.periodo_id = p.id
JOIN ibge_sidra.dimensao AS dim ON d.dimensao_id = dim.id
JOIN ibge_sidra.localidade AS l ON d.localidade_id = l.id
WHERE d.tabela_sidra_id = '1420'
AND d.ativo = TRUE
AND (l.nc = '1')
ORDER BY p.codigo, l.d1c;