research.jflneto.dev.br
Panorama

Panorama da pesquisa

O que foi entregue, quanto falta em cada frente e o que ainda pode dar errado

04/09/2026Panoramaatualizado a cada entrega

Onde a dissertação está, em uma página — o que foi entregue contra o que estava planejado, quanto falta em cada frente e o que ainda pode dar errado. Os números desta página são contados do repositório a cada geração, não escritos à mão.

10/11Blocos experimentais
concluídos; falta E7
11Dias
até o congelamento de 15/09
8/8Pontos de validação
resolvidos com a orientação em 01/09
68,4%Ameaça aberta
das séries elegíveis (min2) tocam dado anterior a 2018
Antes de citar qualquer número

6 páginas já vêm da base canônica só-pública — Run canônico (E1-E9), Base canônica (E0/E5), Qualificação × pipeline, Ensemble: caminhos (E8), Entendendo a curva de compra, Painel interativo (F9). As outras 7 trazem números da base anterior ao reprocessamento: a direção dos achados tende a se manter, os valores exatos vão mudar.

Todas as 13 trazem tarja no topo com o motivo específico e etiqueta no índice. Nenhuma está congelada para o texto.

Quanto falta, por frente

Progresso por módulo de execução do mestradoMÓDULOS DE EXECUÇÃOpercentual contado do repositório a cada geração — a régua de cada módulo está na legenda abaixo da figuraCódigo3/3infra da Fase 1 do plano de fechamento — config.yaml, registry — verificada por leitura direta a cada geraçãoExecução10/11blocos do guia com status concluído — registry/blocos_experimentais.yml, a mesma leitura que o ai.md usaAnálise2/3Fases 4/5/6 do plano de fechamento com evidência de conclusão no registry (campo bloco ou artefato de aceite)Escritasem fontesem fonte verificável neste repositório — fora do plano de fechamentoSite4/4Fases 8/9/11/12 do plano, cada uma pelo artefato publicado no repositório (a Fase 10 é este documento e não entra na conta)

Como ler. cada módulo tem uma régua própria, contada do repositório a cada geração — percentual sem essa régua é decorativo. Execução é blocos concluídos sobre os 11 do guia — a mesma leitura que alimenta blocos_experimentais no ai.md. Código são três checagens de infraestrutura da Fase 1 do plano de fechamento: config.yaml com elegibilidade mínima de 2 anos, o run canônico atualizado no registry, e a higiene das entradas derivadas (toda entrada com run-pai cita o bloco a que pertence). Análise é quantas das Fases 4, 5 e 6 do plano têm evidência de conclusão no registry — a Fase 4 (consolidação do ensemble) ainda não tem o artefato de aceite (relatorio_e8_consolidacao.md); o que existe é a análise preliminar de caminhos do pool P0, que o próprio registro descreve como "pool é parâmetro — refazer com ARIMA". Site é quantas das Fases 8, 9, 11 e 12 têm o artefato correspondente publicado no repositório — a Fase 10 é este documento e fica fora da conta, para a página não se autoavaliar. Escrita não tem fonte verificável aqui: o plano de fechamento trata a redação do texto como fora do seu escopo.

Os pontos resolvidos

8 pontos de validação levantados com a orientação em 08/07 (seção 11), mais o impedimento de elegibilidade aberto em 04/08 — estão todos resolvidos, na sessão de planejamento de 01/09 com o autor. Fonte: registry/impedimentos.yml.

IDPerguntaDecisãoEstado
IMP-1O enquadramento das transições como concentração de erro + mecanismo (e não como "hipótese confirmada") está adequado para a defesa?enquadramento concentração+mecanismo OKresolvido 01/09
IMP-2O Ensino Médio deve entrar no experimento comparativo completo, ou o nível diagnóstico é suficiente caso a reconstrução da escalonada para o EM se mostre custosa?Ensino Médio no comparativo completo (já feito)resolvido 01/09
IMP-3O ajuste de progressão de coorte deve ser validado em amostra nacional ou mantido como estudo de caso (Maceió)?validar em amostra nacional — Fase 3 do plano de fechamentoresolvido 01/09
IMP-4A exclusão de variáveis exógenas nesta versão, com justificativa formal no texto, é aceitável para a banca?exclusão de exógenas com justificativa OKresolvido 01/09
IMP-5O ensemble simples deve entrar na comparação principal ou ser tratado em trabalhos futuros?ensemble entra na comparação principal — o autor o considera possivelmente a maior contribuição do trabalhoresolvido 01/09
IMP-6As datas propostas de congelamento de experimentos e entrega de versão completa estão compatíveis com a agenda da orientação?datas OKresolvido 01/09
IMP-7A taxonomia proposta — séries retroativas, escalonadas, internas, de fronteira e de progressão/coorte — é adequada como eixo organizador da contribuição?taxonomia OKresolvido 01/09
IMP-ELEGElegibilidade mínima de 4 anos ou 2 anos de histórico de treino — decide qual run vira o canônico do Capítulo 5.elegibilidade mínima passa a ser o mínimo possível (2 anos); min4 vira análise de sensibilidade — ver config.yaml, bloco elegibilidaderesolvido 01/09

O que mudou

Desde a versão de 22/07 deste panorama, 7 entregas novas: Run canônico (E1-E9) (29/07), Base canônica (E0/E5) (29/07), Qualificação × pipeline (04/08), Ensemble: caminhos (E8) (01/09), Entendendo a curva de compra (01/09), Painel interativo (F9) (01/09), Como o experimento funciona (02/09). Nesse intervalo o pipeline saiu do papel e produziu o primeiro run canônico completo, e a comparação com a qualificação foi reconciliada número a número.

Uma raia por seção do site, um cartão por entrega publicada — abra para ler o que mudou; o título sozinho já ordena por data dentro da raia. Em âmbar, as entregas cujos números ainda dependem do reprocessamento; a marca "novo" sinaliza o que é posterior à versão de 22/07 deste panorama.

Diagnóstico

Parecer metodológico 06/07

Hierarquiza o que falta até a defesa: uma pergunta, uma explicação, uma prova de conceito, um resultado negativo honesto e um protocolo estatístico único.

Abrir "Parecer metodológico" →

Proposta de encaminhamento 08/07 provisório

Consolida pergunta, taxonomia, escopo, protocolo e métricas numa proposta única — e lista os sete pontos que dependem de decisão da orientação.

Provisório: Os achados da Seção 9 vêm da base atual e serão reprocessados sobre a base canônica só-pública antes de entrar no texto final.

Abrir "Proposta de encaminhamento" →

Oráculo e taxonomia 15/07 provisório

Quantifica o teto da seleção por série — o oráculo chega a 2,33 de MAE — e formaliza a taxonomia. Friedman rejeita a equivalência entre as dez combinações.

Provisório: Números anteriores ao reprocessamento sobre a base canônica só-pública (E1). A direção dos achados tende a se manter; os valores exatos podem mudar.

Abrir "Oráculo e taxonomia" →

Método

Plano de experimentos 03/06

Especifica os cinco experimentos da rodada de Maceió — baselines, estratificação, incerteza, coorte e espacial — com os gates que autorizam cada passo.

Abrir "Plano de experimentos" →

Guia de execução — fechamento da dissertação 08/07 provisório

Fecha o desenho experimental: base canônica só-pública, sete módulos de pipeline e dez experimentos em ordem de prioridade.

Provisório: O critério de elegibilidade descrito abaixo em ‘Elegibilidade’ (≥ 4 anos não nulos na janela de treino) era o desenho original de 08/07/2026. O autor resolveu o IMP-ELEG em 01/09/2026: a elegibilidade mínima vigente é 2 anos (config.yaml, bloco elegibilidade) — min2 é o canônico do Capítulo 5, e o mínimo de 4 anos passou a cenário de sensibilidade. O restante do desenho (escopo, pipeline, ordem dos experimentos) segue como descrito abaixo.

Abrir "Guia de execução — fechamento da dissertação" →

Como o experimento funciona 02/09 novo

Página de método: taxonomia interativa com exemplo ilustrativo de escola, pipeline m10→m70 com docstrings extraídas no build (sem Sphinx), protocolo com fórmulas e o porquê de cada escolha, o controle por etapa refeito (estimar dentro de cada etapa e agrupar por peso compartilhado, não uma etapa isolada), a lista fechada de cortes de escopo, e o roteador — o ensemble a priori que escolhe representação e método antes de prever, com sua cascata de retaguarda e a comparação contra os 5 concorrentes.

Abrir "Como o experimento funciona" →

Resultados

Resultados de Maceió 03/06 provisório

Primeira rodada completa: o naive é o campeão global, e estratificação por etapa, coorte GPR e compra por quantil são as três frentes que conseguem superá-lo.

Provisório: Números anteriores ao reprocessamento sobre a base canônica só-pública (E1). A direção dos achados tende a se manter; os valores exatos podem mudar.

Abrir "Resultados de Maceió" →

Comparação de MAE 04/06 provisório

Confronta a rodada nova com os EXEC anteriores na interseção exata de escolas, séries e anos-alvo, registrando o que ficou de fora por cobertura.

Provisório: Números anteriores ao reprocessamento sobre a base canônica só-pública (E1). A direção dos achados tende a se manter; os valores exatos podem mudar.

Abrir "Comparação de MAE" →

Run canônico (E1-E9) 29/07 novo provisório

Primeiro run completo do pipeline novo, com 16,1M predições: a suavização exponencial e o ensemble batem o baseline de último valor; a escalonada crua perde 21,7% em MAE, mas o teste formal mostra que a diferença vem de uma cauda de previsões ruins, não do caso típico; e a curva de compra traduz o erro em decisão do PNLD — comprar no quantil 95% derruba a falta de 44% para 5% das escolas, ao custo de multiplicar a sobra por 4,7×.

Provisório: Apesar do título, este run deixou de ser o canônico do Capítulo 5 em 01/09/2026: o autor resolveu o IMP-ELEG, baixando a elegibilidade mínima de 4 para 2 anos de histórico de treino, e o canônico passou a ser e1-20260804-175333 (min2) — e1-20260729-122616, o run desta página, desceu a análise de sensibilidade. Os números abaixo não ficaram errados: continuam válidos para o regime de elegibilidade que descrevem (mínimo de 4 anos), só deixaram de ser o resultado que representa o capítulo. E como a elegibilidade muda quais séries entram — o mínimo de 4 anos excluía inteiramente o 3º e o 4º ano do Fundamental, por exemplo —, comparar este run com o min2 é leitura de direção, não de nível: os dois não descrevem a mesma população de séries. Estado atualizado: Panorama da pesquisa e o registry (registry_experimentos.yml, blocos_experimentais.yml). Congela o estado das fases 3 a 6, não o texto final. A representação progressão/coorte (escalonada ajustada pela razão de transição) ainda não foi implementada; a curva de compra usa "último valor" para manter a leitura simples, não o método de menor MAE; a comparação com os números antigos do Cap.05 fica para o autor. Com N na casa dos milhões, todo p-valor sai < 0,001 — a leitura correta é sempre o tamanho de efeito.

Abrir "Run canônico (E1-E9)" →

Ensemble: caminhos (E8) 01/09 novo provisório

Primeira leitura de 'para onde o ensemble pode ir' sobre o pool de 5 métodos: podar o reglin piora, selecionar por estrato bate combinar mas fica a 4 alunos do oráculo, e o leque das predições subcobre o valor real em mais da metade dos casos.

Provisório: O pool tem 5 métodos (média, último valor, reglin, suavização exponencial, Kalman) — o ARIMA ainda não entrou. Quando m40b_arima.py gravar predicoes_arima.parquet, esta análise inteira se refaz trocando só a flag --metodos de tools/analise_ensemble.py, sem editar o script. A leitura interpretativa abaixo (o que cada número sugere fazer a seguir) é rascunho de quem executou a análise, não texto do autor da dissertação — os números foram conferidos contra os CSVs, as conclusões sobre eles ainda não passaram pelo autor. Nada aqui altera o run canônico nem as páginas já publicadas: é um recorte novo sobre os mesmos dados de e1-20260804-175333.

Abrir "Ensemble: caminhos (E8)" →

Entendendo a curva de compra 01/09 novo provisório

Página didática, não um novo resultado: explica do zero o que é comprar no quantil q de uma distribuição de erro, por que faltar livro e sobrar livro não são o mesmo tipo de erro, de onde saiu o p*≈0,70–0,80 do estudo de caso de Maceió — e por que ele não pode ser copiado para a curva nacional sem uma razão de custo que este trabalho não estimou.

Provisório: Página inteiramente didática — toda a prosa abaixo é rascunho do executor de tarefas, escrito para o autor estudar e conseguir defender o E9 (ele registrou que ainda não domina o tema o bastante), e ainda não passou pela voz do autor. Prioriza explicar bem três ou quatro ideias a cobrir tudo sobre quantis; não é uma referência completa de teoria de decisão. Os números de Maceió vêm de uma rodada anterior ao reprocessamento sobre a base canônica só-pública (ver o próprio aviso em resultados/maceio-t2.html) — tratados aqui como o que são, um estudo de caso histórico que motivou a pergunta, não uma validação nacional.

Abrir "Entendendo a curva de compra" →

Painel interativo (F9) 01/09 novo provisório

Uma única tabela dinâmica, alimentada pelo run canônico min2 (e1-20260804-175333), responde qualquer corte de método × representação por etapa, posição, ano-alvo, UF, região, dependência ou porte em até dois cliques, com exportação CSV do recorte exibido — mais a curva por etapa com as fronteiras 5º→6º e 9º→1ªEM destacadas, a direção do erro traduzida em falta/sobra de livro, a matriz de efeito dos testes E6, o mapa de WAPE relativo por UF, a comparação com a qualificação e a curva de compra/risco interativa (min2), com um efeito da mudança de elegibilidade que não é uniforme: melhora marginal entre p50 e p80, inversão mais visível em p90.

Provisório: Os 8 componentes planejados na Fase 9 estão nesta página, incluindo a curva de compra/risco (seção 'Curva de compra e risco'), preenchida com a curva E9 sobre o run min2 assim que ela ficou disponível. O ARIMA ainda não entra em nenhuma comparação de método desta página — não existe no run e1-20260804-175333. Toda leitura interpretativa abaixo (os parágrafos fora das tabelas e legendas), incluindo a comparação min2×min4 da curva de compra, é rascunho do executor de tarefas, não texto do autor — os números foram lidos de CSV do run, mas a costura em prosa ainda não passou por revisão.

Abrir "Painel interativo (F9)" →

Validação

Transições críticas 17/06 provisório

Testa a hipótese das transições em escala nacional, com nove evidências e teste formal. Veredito parcial: 2 de 3 indicadores apoiam.

Provisório: Números anteriores ao reprocessamento sobre a base canônica só-pública (E1). A direção dos achados tende a se manter; os valores exatos podem mudar.

Abrir "Transições críticas" →

Gargalo nacional 01/07 provisório

Leva o baseline original ao Brasil inteiro e mostra o erro subindo justamente nas etapas que recebem transição, em 33 recortes geográficos.

Provisório: Números anteriores ao reprocessamento sobre a base canônica só-pública (E1). A direção dos achados tende a se manter; os valores exatos podem mudar.

Abrir "Gargalo nacional" →

Base canônica (E0/E5) 29/07 novo provisório

Base só-pública do pipeline novo construída e validada — 7,6M observações escola-etapa-ano, com duas ameaças à validade documentadas — e a primeira leitura estatística de por que repetir o último valor é difícil de superar: metade dos pares varia menos de 21% de um ano para o outro, e as etapas de fronteira não são mais instáveis que as internas.

Provisório: E0 valida a construção, não os números finais: a dependência administrativa vem de um snapshot único (2025) e a base bruta tem uma descontinuidade pré-2018 — as duas seguem como ameaças à validade até investigação futura. As descritivas de E5 rodaram antes da modelagem; a leitura de estabilidade tende a se manter, mas os valores exatos podem mudar. Um detalhe do corpo envelheceu em 01/09/2026: onde se lê “folga sobre o mínimo de 4 anos”, a elegibilidade mínima passou a ser 2 anos (IMP-ELEG resolvido pelo autor). O número do KPI não muda — esta caracterização vem do E5 e independe do corte de elegibilidade —, a folga apenas ficou maior do que a frase diz.

Abrir "Base canônica (E0/E5)" →

Qualificação × pipeline 04/08 novo provisório

A diferença entre o resultado da qualificação e o do pipeline não vem das mudanças de universo, como se supunha: filtrar rede, anos e etapas move o MAE da retroativa de 9,54 para 9,80. O sinal do agregado vira num único degrau — a exigência de 4 anos de histórico — e vira para os cinco métodos sem exceção. A vantagem da escalonada vinha inteira das séries que esse critério elimina, e não porque séries curtas sejam melhores: o comprimento da cadeia é função determinística da etapa, e a vantagem acaba quando a cadeia passa a cruzar a transição 5º→6º ano. A rodada de sensibilidade confirma: baixando o critério para 2 anos, o 4º ano volta com WAPE 15,5%, o menor da tabela. Além disso, dos segmentos testados só porte e regularidade da série sobrevivem ao controle por etapa — rede, região e localização eram composição.

Provisório: O texto abaixo — sobretudo o item B ("O mínimo de 4 anos segue sendo o canônico") e as referências a "o run canônico" ao longo da página — ficou desatualizado em 01/09/2026: o autor resolveu o IMP-ELEG, baixando a elegibilidade mínima de 4 para 2 anos, e o canônico do Capítulo 5 passou a ser e1-20260804-175333 (min2); e1-20260729-122616 (min4), o run que esta página trata como canônico — na escada, nos segmentos, na anomalia do Ceará e na validação do ARIMA —, desceu a análise de sensibilidade. Os números não ficaram errados: continuam válidos para o regime de elegibilidade que descrevem, e são a base do próprio achado da página — que a elegibilidade é o degrau que inverte o sinal entre retroativa e escalonada. No item B os papéis se invertem com a virada: a coluna "mín. 4", chamada de canônica no texto, é hoje a sensibilidade; a coluna "mín. 2", chamada de "rodada de sensibilidade", é hoje o canônico. Como a elegibilidade muda quais séries entram, ler as duas colunas continua sendo comparação de direção — o 3º e o 4º ano voltam a existir e a escalonada volta a vencer nas etapas iniciais —, não de nível. Estado atualizado: Panorama da pesquisa e o registry (registry_experimentos.yml, blocos_experimentais.yml). Três números da auditoria de 04/08 não foram reproduzidos e estão marcados como tal no texto. A causa mecânica da descontinuidade de 2018 segue indeterminada.

Abrir "Qualificação × pipeline" →

Onde o cronograma de julho ficou

Cronograma das fases: previsto contra realizadoCRONOGRAMA: PLANO CONTRA REALIZADObarra tracejada é o previsto no plano de execução de 29/07/2026, seção 3 (fases 0–6, histórico) e plano de fechamento de 01/09/2026 — PLANO_FECHAMENTO_2026-09.md (fases 1–12 do fechamento, vigente); ponto cheio é quando a entrega ficou pronta27/073/0810/0817/0824/0831/087/0914/09Fase 0estrutura do repositóriono prazoFase 1base canônica e sanidade (E0)−4 diasFase 2caracterização e persistência (E5)−7 diasFase 3run canônico retroativo (E1)−13 diasFase 4escalonada, ensino médio e comparação(E2–E4, E-EM)−20 diasFase 5protocolo estatístico e ensemble (E6, E8)−24 diasFase 6condicionais (E7, E9) e tabelas do textoabsorvida pelo plano de fechamento de 01/09 (PLANO_FECHAMENTO_2026-09.md): E9 segue concluído desde 29/07, mas sobre a base min4 — refazer sobre min2 é Fechamento F1; E7 vira Fechamento F3; as tabelas do texto passam a depender das Fechamento F4/F5/F9Não planejadoauditoria, reconciliação qualificação ×pipeline e ARIMAcongelamentohojeprevistorealizadotrabalho que não estava no planoa faixa hachurada é margem, não prazo de trabalho

Como ler. a barra tracejada é o que o plano de 29/07 previa; o ponto cheio é quando a entrega ficou pronta. As fases 1 a 5 fecharam todas em 29/07, de 4 a 24 dias antes do previsto — e o tempo ganho foi consumido pelo bloco roxo, que não estava no plano: a auditoria, a reconciliação com a qualificação e o ARIMA. O que restava desse plano migrou para o plano de fechamento de 01/09 — ver "Até a defesa", abaixo.

Até a defesa

Quatro marcos entre hoje e a defesa. Só dois têm data: o plano de fechamento afirma o congelamento (15/09) e a agenda da orientação confirmou a defesa prevista (30/11) — versão completa do texto e depósito não aparecem com prazo em nenhum documento do plano, e isso não é preenchido aqui: ausência de data é informação, não lacuna. "Em risco" é regra, não impressão: menos de 15 dias para o marco e algum módulo de Execução, Código ou Análise (seção acima) ainda abaixo de 100%.

MarcoDataEstadoFaltam
Congelamento de experimentos15/09em risco11 dias
Versão completa do textosem data afirmada—fora do escopo do plano de fechamento
Depósitosem data afirmada—o plano não afirma esta data
Defesa30/11previsto87 dias

O que já rodou

Estado dos blocos experimentais do guia de execuçãoOS BLOCOS EXPERIMENTAISguia de execução, §7 — cada bloco liga ao documento que o publicaE0✓E1✓E2✓E3✓E4✓E5✓E6✓E-EM✓E8✓E9✓E7falta10 de 11 concluídosfalta E7: coorte/GPR fora de Maceió (condicional — depende do ponto 3)

Como ler. os blocos do guia de execução na ordem em que foram concluídos. O E-EM não custou código próprio — a reconstrução da escalonada do Ensino Médio saiu da forma como a cadeia de progressão foi implementada.

Mapa de cobertura: frentes experimentais por faixa de etapasO QUE JÁ ESTÁ COBERTOcada célula é uma frente experimental numa faixa de etapasO escopo é a educação básica regular, do 1º ano do Fundamental à 3ª série do Médio (config.yaml, etapas_alvo). A pré-escola entra só como origem da cadeia deprogressão, nunca como etapa-alvo, e creche está fora — educação infantil foi escopo do TCC, não desta dissertação.RetroativaEscalonadaProgressão / coorteEnsemble e roteadorIncerteza e compraEF anos iniciais1º ao 5º anonacionalparcial3º ao 5º anoMaceióinternasnacionalcom roteadornacionalEF anos finais6º ao 9º anonacionalnacionalMaceióinternasnacionalcom roteadornacionalEnsino médio1ª à 3ª sérienacionalnacionalvia E-EM—nacionalcom roteadornacionalrodado em escala nacionalrodado só em Maceiócobertura parcial da faixaainda não rodadoFRENTES ENCERRADASEspacial (fronteiras)testada nas três transições críticas (pré→1ºEF, 5º→6ºEF, 9ºEF→1ªEM), sem efeito — encerrada como limitação declarada; reabresó por rede de ensino

Como ler. verde é escala nacional, âmbar é estudo de caso em Maceió, azul é cobertura parcial da faixa e tracejado é o que ainda não rodou. A escalonada nos anos iniciais é parcial por construção, não por falta de rodada: a cadeia precisa de elos anteriores ao alvo, que não existem para o 1º e o 2º ano — ela cobre do 3º ao 5º. O único buraco é a coorte fora de Maceió, que é exatamente o E7, programado em amostra nacional pela Fase 3 do plano de fechamento.

Como o pipeline roda

Fluxo do pipeline: módulos 10 a 70 em sequência

Como ler. os sete módulos numéricos, em ordem — a mesma figura que pipeline/m70_relatorios.py::_fig_fluxograma gera para o relatório de cada run, publicada em Como o experimento funciona e reaproveitada aqui, não redesenhada.

O que já foi feito

35 commits, agrupados por dia (excluídos merges e commits de infraestrutura de deploy — prefixo ci:) e cruzados com as entradas do registry datadas do mesmo dia. Fonte: git log + registry/registry_experimentos.yml.

DiaCommitsRuns no registry
22/07
  • Panorama para a orientação, proposta publicada e guia sem prazos 77c8ac2
  • Guia interno de execução como página visual 398bb70
  • Deploy via GHCR: sem build no Portainer, healthcheck e labels OCI d75ce33
  • Site da pesquisa: tema único, busca e deploy via Portainer f41525a
—
28/07
  • Corrige sobreposição de texto na linha do tempo do panorama 9c3c165
  • Migra deploy de Portainer/GHCR para Coolify 253bd96
—
29/07
  • resultados: WAPE por etapa e método, retroativa x escalonada (sem pareamento) 7c9d582
  • m70 + E9: relatórios, figuras e curva de compra/risco 2cfffac
  • m60 + E6 + E8: protocolo estatístico unificado e ensemble e3f7fdb
  • escalonada + E-EM + E2/E3/E4: retroativa vence a coorte crua 58577ad
  • m30/m40/m50 retroativa + E1: primeiro run canônico a5a7bd0
  • m20 + E5: caracterização e persistência (por que o último valor é forte) df27183
  • m20 quick-win: página "base canônica só-públicas" no site 426d3a2
  • m10 + tests: observacoes.parquet e mapa de transições (E0) 42ae86c
  • scaffold: estrutura pipeline + gitignore/dockerignore (deploy intacto) b0f0e1b
e0-20260729-112118, e5-20260729-113857, e1-20260729-122616
04/08
  • validacao: reconciliação entre a qualificação e o pipeline 483b9d0
  • pipeline: sensibilidade min_anos_treino=2, cobertura avaliável e ARIMA 58c50bc
  • tema: tabelas ordenáveis e filtráveis 6299235
  • m70 export-site: nunca escrever em caminho publicado 352cef6
  • site: consolida as 7 páginas de 29/07 em duas (resultados e validação) a2fcfcc
e1-20260804-175333
11/08
  • panorama: mede progresso em vez de descrever estado congelado 46682bd
  • validacao: publica resultado do ARIMA na página qualificação × pipeline fb326f7
e1-20260729-122616-arima
01/09
  • site: fases 6, 9 e 10, modulo 70 sobre min2, e registry dos derivados b058969
  • site: fases 5, 11 e 12 -- backlog cientifico, pagina do metodo e modo escuro 7e840cb
  • resultados: publica os caminhos de melhoria do ensemble e vira as tarjas 1322f99
  • analise: caminhos de melhoria do ensemble + previa local fiel ao nginx a6b1272
  • site: ai.md e llms.txt gerados pelo build (Fase 8) 21b50f3
  • pipeline: promove min2 a canônico e saneia o registry 931d893
e1-20260804-175333+m70, e1-20260804-175333+backlog, e1-20260804-175333+quebra2018, e1-20260804-175333+ensemble
02/09
  • roteador, dashboard e duas auditorias d355782
  • analise: redes de ensino, universos comparaveis e controle por etapa 42961b3
  • pipeline+site: ARIMA sobre min2, E6 completo, uniformizacao e correcoes 5b19e62
e1-20260804-175333-arima, e1-20260804-175333-e6-full
04/09
  • oraculo e roteador: a margem ate o teto era sorte, e o 9,89 tinha vazamento f2ec680
  • metodo: a cascata do roteador saia toda preta 07456bf
  • panorama: o mapa de cobertura contava uma historia pior que a real 8a75f4e
  • build: conserta o deploy e fecha o ponto cego que o deixou passar 1b431e3
—

O que ainda pode dar errado

0 ameaças à validade seguem abertas — sem mecanismo identificado — e as demais estão declaradas ou contornadas. Nenhuma invalida o que está publicado; todas precisam de uma frase no texto antes da defesa.

RiscoEfeitoEstadoOnde está
Descontinuidade 2017→2018 na base bruta68,4% das séries elegíveis tocam dado anterior a 2018. Causa identificada em 04/09: o período pré-2018 de brasil_2007_2025.csv tem ~1/3 das linhas escola×etapa — a base de 2015 tem 25,5% da rede pública daquele ano, contra 81,4% em 2018. Os valores estão certos (razão mediana 1,00 na mesma escola e etapa entre 2017 e 2018); faltam linhas. Não é mudança de metodologia do INEP: os manuais de 2017 e 2018 são idênticos.declarado no textoQualificação × pipeline
Dependência administrativa por snapshot de 2025viés de sobrevivência — escolas extintas antes de 2025 ficam de foradeclarado no textoBase canônica (E0/E5)
Efeito Cearásobrevive a todos os controles testados, sem mecanismo identificadodeclarado no textoQualificação × pipeline
Elegibilidade mínima: 4 anos ou 2degrau que inverte o sinal retroativa×escalonada; painel e texto precisam dizer qual dos dois números usamdeclarado no textoQualificação × pipeline
Cobertura da escalonada32,0% contra 81,1% da retroativa — nivela por baixo toda comparação pareadadeclarado no textoRun canônico (E1-E9)
Três números da auditoria de 04/08 não reproduzema conclusão sobrevive porque se apoia no WAPE, que está corretocontornadoQualificação × pipeline

Qual é o argumento

O argumento da dissertação em cinco passos encadeadosO ARGUMENTO EM CINCO PASSOScada passo se apoia no anterior; clique para abrir o documento que o sustenta1A estruturaçãotemporal dos dadosafeta a predição?Pergunta de pesquisa,aceita na qualificação emantida.2Afeta — mas deforma mista, nãomais uniformePareado por escola, etapa,ano e método (T5, min2):kalman e último valor játêm MAE médio menor naescalonada (10,89 e 10,94contra 11,00 e 11,22) —nenhum invertia no min4.Nos outros cinco aretroativa segue à frente.2 de 73Podar piora,selecionar batecombinarTirar o reglin — piormétodo isolado — do poolpiora a média nas duasrepresentações (retroativa:11,16→11,31). Fora daamostra, o seletor porestrato (10,45) bate amédia simples (10,61), masfica a 4,05 alunos dooráculo por unidade.+1,3%4O que sobra éheterogeneidade deescalaO MAE por etapa vai de 7,3a 29,7 — 4× de variação —mas o WAPE fica nessa faixaestreita em quase toda acurva (T3, retroativa,ensemble por média): étamanho de etapa, não piorade ajuste.21,5–27,2%5E isso vira decisãode compraComprar no quantil 95%derruba a falta de 44,3%para 4,9% das escolas (E9,min2), ao custo de 4,7× desobra — quase idêntico aomin4.44,3%→4,9%proposta →painel interativo →caminhos do ensemble →por etapa →curva de compra →

Como ler. os números vêm de blocos experimentais distintos e não são comparáveis entre si — cada um é válido dentro do documento que o gerou, indicado no rodapé de cada passo. Os passos 2 e 3 mudaram de fundo, não só de número, com a virada para min2 (run e1-20260804-175333, canônico desde 01/09): a inversão retroativa×escalonada deixou de ser uniforme, e o passo que antes explicava a virada de julho pela elegibilidade — hoje resolvida (IMP-ELEG) — foi substituído pela lição estrutural do ensemble. O comparativo de métodos ainda não inclui ARIMA, que está rodando sobre min2 em paralelo a esta revisão; as tabelas ganham uma linha quando terminar. O run e1-20260729-122616 (min4) segue válido como análise de sensibilidade.

O que vem a seguir

Com os oito pontos de validação resolvidos em 01/09 e a elegibilidade mínima decidida — 2 anos, min2 já é o canônico do Capítulo 5 — o que falta até o congelamento de 15/09 é execução, não decisão: o ARIMA e o E6 completo sobre a base min2, o E7 em amostra nacional e a consolidação do ensemble (módulos Código, Execução e Análise, acima). Depois do congelamento, só site e escrita.