Censo 2022 Indígena — dataset consolidado com crosswalk etnolinguístico (Brasil)
收藏资源简介:
Censo 2022 Indígena — dataset consolidado com crosswalk etnolinguístico Dataset de apoio à pesquisa sobre regimes de proteção da pessoa indígena e direitos linguísticos no Brasil, construído a partir das divulgações do Censo Demográfico 2022 (IBGE), do Quadro Geral dos Povos (ISA/Siasi-Sesai), do Glottolog 5.x e do INDL/Iphan. Conteúdo censo2022_indigena_dataset.xlsx — 8 abas: agregados 2022×2010 · línguas (falantes + glottocode + família) · etnias · rankings territoriais · 160 povos × família × população (com camada de proveniência) · correspondência tradição brasileira ↔ Glottolog · crosswalk (62 pares nome-censo → glottocode) · 260 línguas BR do Glottolog data/*.csv — as mesmas tabelas em formato aberto pipeline/pipeline_sidra.py — extrator reprodutível (API SIDRA → dataset) Proveniência e advertências Cada tabela declara camada de origem (IBGE / ISA-Siasi / Glottolog / a-conferir). Três advertências obrigatórias para reúso: (1) as contagens IBGE, Siasi e Glottolog medem objetos distintos e NÃO são intercambiáveis; (2) a série censitária 2010–2022 não é comparável no agregado (mudança de instrumento); (3) o pareamento censo↔Glottolog é estruturalmente N:M. Detalhes na aba leia-me. Licença e citação Dados derivados: CC-BY 4.0 (Glottolog: Hammarström et al., CC-BY 4.0; dados IBGE: públicos; ISA: compilação de fontes públicas Siasi/Sesai). Citação sugerida em CITATION.cff. v2.1 (29/09/2026) — as tabelas de Mato Grosso que o livro nomeia Esta versão acrescenta, no arquivo censo2022-indigena_v2.1_mato-grosso.zip: 1. A errata da v2.0 (ERRATA-PARA-O-v2.1.md) — correções de nome de base e de um termo, sem alteração de número. 2. Os doze arquivos de dados que a Nota metodológica do livro Povos de Mato Grosso nomeia, um a um — e mais nenhum. 3. As duas tábuas da água (terras-por-bacia.csv, terras-por-rio.csv), medidas dos pontos do Censo 2022 em EPSG:5880, localidade a localidade. Cada número é um mínimo. 4. MANIFESTO-CSV.txt — linhas e sha256 de cada arquivo, para quem baixar conferir. Duas convenções destes arquivos: o traço "-" numa célula significa "não medido", e não zero; e o separador é o ponto-e-vírgula em dez dos doze arquivos. O arquivo da v2.0 permanece nesta versão, sem alteração. v2.0 (18/08/2026) — cobertura nacional Abas novas no dataset: br_municipios (todos os municípios do Brasil com população indígena, 27 UFs), br_tis (602 terras), br_ranking_municipios, br_ranking_tis, br_gradiente_uf. Validação: soma municipal EXATA contra o total oficial de cada uma das 27 UFs; soma nacional = 1.694.836 (total oficial do Censo 2022). Método de extração para UFs grandes: fatiamento por mesorregião (nível n8 da API SIDRA). Acompanham: relatório interpretativo (relatorio-brasil-municipal-indigena.pdf), painel interativo offline (painel-brasil-indigena.html) e os CSVs brutos por UF (data/nacional/). Recorte MT completo (data/mt_*.csv): municípios, TIs, etnias×TI, línguas×TI, vínculo município→comarca OFICIAL (COJE/TJMT validado 141/141). As opiniões e a compilação são de responsabilidade exclusiva da autora e não representam posição institucional do Ministério Público do Estado de Mato Grosso. Nenhuma pessoa física é nomeada. Não se publica coordenada de aldeia, de domicílio ou de pessoa: as únicas coordenadas do conjunto são os pontos de língua do Glottolog, redistribuídos sob CC BY 4.0. Pedidos de correção, complemento ou remoção geram nova versão do depósito.



