Estudo de caso

Uma leitura guiada da coleta à exploração

Percurso analítico do projeto Sessão da Tarde.

O projeto é apresentado em três etapas. A ordem importa: a análise final depende de uma listagem coletada, de regras de limpeza e do enriquecimento com metadados de filmes.

01 · ORIGEM

Construção da base

O primeiro notebook transforma a listagem do TV Globo Wiki em uma tabela de datas, títulos e observações. Ele documenta a lógica original de extração e gera whole_century.csv.

Entrada: página HTML externa
Saída: 10.466 registros brutos

Ler esta etapa

02 · CURADORIA

Limpeza dos registros

O segundo notebook exclui linhas sem título e dias identificados como sem exibição. Quando a fonte registra filmes diferentes para regiões distintas na mesma linha, mantém o primeiro título.

Entrada: whole_century.csv
Saída: 9.900 registros limpos

Ler esta etapa

DicaPara leitores não técnicos

O código aparece recolhido por padrão. Abra “Ver código” quando quiser conferir como uma tabela ou gráfico foi produzido; os textos e resultados podem ser lidos sem executar nada.

De volta ao topo