research.jflneto.dev.br
Sobre

Sobre este site

O que está publicado aqui, como foi gerado e o que ainda não está

22/07/2026Sobrepágina permanente

Este site reúne, num lugar só, os relatórios e análises que venho gerando ao longo da dissertação de mestrado no PPGI/UFAL. Cada entrega semanal vira uma página, com o mesmo tema visual e o mesmo vocabulário de gráficos.

A pesquisa

A dissertação investiga se a forma de estruturar temporalmente os dados de matrícula escolar influencia o desempenho de modelos preditivos, no contexto do planejamento do Programa Nacional do Livro e do Material Didático (PNLD). A unidade de análise é a combinação escola × etapa de ensino × ano, construída a partir do Censo Escolar da Educação Básica.

Discente
José Ferreira Leite Neto
Programa
Mestrado em Informática, PPGI — Universidade Federal de Alagoas
Orientação
Prof. Dr. Bruno Almeida Pimentel
Coorientação
Prof. Dr. Glauber Rodrigues Leite
Fonte de dados
Censo Escolar da Educação Básica (INEP), 2007–2025
Métrica principal
MAE, por ser interpretável em número médio de alunos

Como ler o que está publicado

Estado do material

Nada aqui é resultado final de dissertação. São documentos de trabalho: pareceres, planos de experimento, validações parciais e rodadas exploratórias, cada um com a data em que foi produzido. Números de um documento podem ter sido revistos em outro mais recente — a data no cabeçalho é a referência.

Os documentos estão organizados em quatro seções. Diagnóstico reúne pareceres sobre o estado da pesquisa e as decisões em aberto. Método traz o desenho experimental. Resultados traz as rodadas executadas. Validação reúne as evidências sobre o comportamento das séries, em especial nas transições entre etapas.

Reprodutibilidade

A qualificação registrou como requisito que a metodologia permita reproduzir o trabalho, com critérios de limpeza documentados, divisão treino/teste explícita e link público para os dados. Esses itens estão sendo consolidados e serão publicados aqui conforme ficarem prontos.

Ainda não publicado
  • Link público para os recortes de dados usados em cada experimento.
  • Documentação dos critérios de limpeza e filtragem das séries.
  • Divisão treino/teste com percentuais e justificativa.
  • Algoritmos e fluxogramas dos processos hoje descritos em prosa.

Como o site é gerado

O conteúdo vive num repositório Git como fragmentos HTML com metadados. Um script de build em Python monta as páginas sobre um template único, gera o sumário lateral e o índice de busca, e o resultado é servido por Nginx dentro de um contêiner. Não há framework de front-end: a única biblioteca carregada é o Plotly, e só nas páginas que têm gráfico.

Transformações aplicadas na migração

Os documentos originais usavam quatro bibliotecas de gráfico diferentes (Plotly, ECharts, Chart.js e figuras estáticas do matplotlib) e chegavam a 19 MB por arquivo. Na unificação, três transformações foram aplicadas — todas preservam o que a figura mostra:

Registro das transformações
Histogramas
O traço histogram carregava a amostra bruta e refazia a contagem no navegador. A contagem passou a ser feita no build, com o mesmo número de classes, e o traço virou bar.
Boxplots
Desenhados com boxpoints=false, isto é, sem pontos individuais. Quartis, mediana e limites de Tukey passaram a ser pré-computados (método linear, o padrão do Plotly), dispensando a amostra bruta.
ECharts e Chart.js
Os gráficos foram reconstruídos em Plotly a partir dos mesmos dados que estavam embutidos nos arquivos originais. Nenhum número foi recalculado.

Efeito somado: as figuras da Validação Transição saíram de 16,2 MB para 2,2 MB, e a apresentação de resultados de Maceió saiu de 1,05 MB para cerca de 16 KB de HTML mais os dados de cada gráfico, carregados só quando a figura entra na tela.

Contato

Correções, dúvidas e sugestões: jflneto.br@gmail.com.