1. Evidência de edital
Certames entram na base com URL oficial, instituição, ano, banca, cargo/perfil e data de verificação. O edital descreve o universo declarado de cobrança, não aquilo que necessariamente apareceu no caderno aplicado.
A cartografia só é útil se deixar claro o que veio do edital, o que foi efetivamente observado em prova, o que foi normalizado pelo projeto e qual conjunto de dados sustenta cada comparação.
Certames entram na base com URL oficial, instituição, ano, banca, cargo/perfil e data de verificação. O edital descreve o universo declarado de cobrança, não aquilo que necessariamente apareceu no caderno aplicado.
A M4 mantém um corpus separado de cadernos efetivamente aplicados. Cada registro guarda estrutura da prova, temas observados, nome do arquivo e SHA-256. Os PDFs não são redistribuídos pelo repositório.
Nomes como “Infraestrutura e Redes” ou “Generalista” são categorias do projeto. Elas conectam nomenclaturas diferentes sem fingir que editais ou provas são idênticos.
Toda trilha pode ser ligada a blocos amplos como Redes, Banco de Dados ou Governança. Essa camada permite navegar mesmo antes de uma fonte ser decomposta integralmente.
Itens como VLAN, IPv6, normalização, COBIT 2019 ou ITIL 4 são associados a uma taxonomia comum. O rótulo da taxonomia continua sendo uma síntese, não uma citação literal do documento.
A comparação de editais usa interseção de conjuntos. Macroconhecimentos oferecem um sinal amplo; a comparação granular só aparece quando os dois editais possuem tópicos decompostos. Nenhum percentual mede dificuldade, peso ou chance de aprovação.
A frequência da M3 usa a trilha/cargo-perfil como unidade de análise. No modo macro, o denominador contém todas as trilhas do recorte. No granular, apenas trilhas de edital já decompostas. Provas reais não entram nessa conta.
A M4 prepara uma métrica distinta: presença ou quantidade de questões observadas em cadernos reais. Ela só será agregada quando a classificação questão a questão tiver denominador próprio e cobertura revisada.
A M5 trata localização como uma relação entre certame, trilha e território. Uma trilha pode ter várias cidades; outra pode existir apenas em nível estadual; uma abrangência nacional não é transformada artificialmente em um ponto no centro do país.
Somente trilhas com localização suficientemente decomposta entram no mapa. “Múltiplas localidades” e abrangências nacionais permanecem em uma fila explícita de normalização. A interface informa quantas trilhas do recorte estão geocodificadas.
Um estado mais intenso no modo de cobertura significa apenas que mais trilhas catalogadas e geocodificadas daquele recorte estão associadas à UF. Não significa mais vagas, maior frequência de concursos ou melhor mercado.
No modo de compatibilidade da M5, cada UF recebe o maior Jaccard macro entre a trilha de referência e as trilhas geocodificadas do recorte. É uma forma de localizar reaproveitamento conceitual, não de estimar aprovação, remuneração ou atratividade.
O “núcleo” é apenas o conjunto de itens que alcança um limiar escolhido dentro de um recorte. Ele descreve a amostra catalogada; não é uma lista universal de prioridades de estudo.
Dados, fontes, taxonomia, localizações e extrações vivem no repositório e mudam por commit. Para provas recebidas como arquivo, o SHA-256 identifica exatamente o caderno que sustentou a curadoria sem exigir que o PDF seja versionado.
Em editais, “macro” e “tópicos” indicam o nível de decomposição do programa. Em provas, “parcial” significa que já existem temas classificados, mas o caderno ainda não passou por classificação exaustiva questão a questão.
Frequência de presença não significa percentual da prova, número de questões, dificuldade ou esforço de estudo. Edital, prova e geografia respondem perguntas diferentes e permanecem em camadas distintas.
A amostra não representa automaticamente todo o universo de concursos brasileiros. Frequências, observações e mapas descrevem a base atual e devem ser interpretados como evidência exploratória, não como estimativa populacional.