Este site reúne, num lugar só, os relatórios e análises que venho gerando ao longo da dissertação de mestrado no PPGI/UFAL. Cada entrega semanal vira uma página, com o mesmo tema visual e o mesmo vocabulário de gráficos.
A pesquisa
A dissertação investiga se a forma de estruturar temporalmente os dados de matrícula escolar influencia o desempenho de modelos preditivos, no contexto do planejamento do Programa Nacional do Livro e do Material Didático (PNLD). A unidade de análise é a combinação escola × etapa de ensino × ano, construída a partir do Censo Escolar da Educação Básica.
- Discente
- José Ferreira Leite Neto
- Programa
- Mestrado em Informática, PPGI — Universidade Federal de Alagoas
- Orientação
- Prof. Dr. Bruno Almeida Pimentel
- Coorientação
- Prof. Dr. Glauber Rodrigues Leite
- Fonte de dados
- Censo Escolar da Educação Básica (INEP), 2007–2025
- Métrica principal
- MAE, por ser interpretável em número médio de alunos
Como ler o que está publicado
Nada aqui é resultado final de dissertação. São documentos de trabalho: pareceres, planos de experimento, validações parciais e rodadas exploratórias, cada um com a data em que foi produzido. Números de um documento podem ter sido revistos em outro mais recente — a data no cabeçalho é a referência.
Os documentos estão organizados em quatro seções. Diagnóstico reúne pareceres sobre o estado da pesquisa e as decisões em aberto. Método traz o desenho experimental. Resultados traz as rodadas executadas. Validação reúne as evidências sobre o comportamento das séries, em especial nas transições entre etapas.
Reprodutibilidade
A qualificação registrou como requisito que a metodologia permita reproduzir o trabalho, com critérios de limpeza documentados, divisão treino/teste explícita e link público para os dados. Esses itens estão sendo consolidados e serão publicados aqui conforme ficarem prontos.
- Link público para os recortes de dados usados em cada experimento.
- Documentação dos critérios de limpeza e filtragem das séries.
- Divisão treino/teste com percentuais e justificativa.
- Algoritmos e fluxogramas dos processos hoje descritos em prosa.
Como o site é gerado
O conteúdo vive num repositório Git como fragmentos HTML com metadados. Um script de build em Python monta as páginas sobre um template único, gera o sumário lateral e o índice de busca, e o resultado é servido por Nginx dentro de um contêiner. Não há framework de front-end: a única biblioteca carregada é o Plotly, e só nas páginas que têm gráfico.
Transformações aplicadas na migração
Os documentos originais usavam quatro bibliotecas de gráfico diferentes (Plotly, ECharts, Chart.js e figuras estáticas do matplotlib) e chegavam a 19 MB por arquivo. Na unificação, três transformações foram aplicadas — todas preservam o que a figura mostra:
- Histogramas
- O traço
histogramcarregava a amostra bruta e refazia a contagem no navegador. A contagem passou a ser feita no build, com o mesmo número de classes, e o traço viroubar. - Boxplots
- Desenhados com
boxpoints=false, isto é, sem pontos individuais. Quartis, mediana e limites de Tukey passaram a ser pré-computados (método linear, o padrão do Plotly), dispensando a amostra bruta. - ECharts e Chart.js
- Os gráficos foram reconstruídos em Plotly a partir dos mesmos dados que estavam embutidos nos arquivos originais. Nenhum número foi recalculado.
Efeito somado: as figuras da Validação Transição saíram de 16,2 MB para 2,2 MB, e a apresentação de resultados de Maceió saiu de 1,05 MB para cerca de 16 KB de HTML mais os dados de cada gráfico, carregados só quando a figura entra na tela.
Contato
Correções, dúvidas e sugestões: jflneto.br@gmail.com.