O CSV Profiler gera um relatório rápido de qualidade de dados a partir de um CSV. Para cada coluna ele infere o tipo, conta valores nulos e distintos, e calcula estatísticas como mínimo, máximo e média (para números). É o primeiro passo de qualquer análise exploratória de dados.
Tudo roda localmente no navegador, então você pode perfilar dados sensíveis sem riscos.
Como funciona
A ferramenta faz o parsing do CSV, percorre cada coluna e infere o tipo predominante (inteiro, decimal, booleano, data ou texto). Em seguida calcula: total de valores, nulos/vazios, valores únicos (cardinalidade), e — para colunas numéricas — mínimo, máximo e média. Também mostra amostras de valores.
Como usar
Cole o CSV. Inclua o cabeçalho na primeira linha.
Gere o perfil. Clique em Perfilar para analisar todas as colunas.
Interprete o relatório. Observe nulos, cardinalidade e tipos por coluna.
Aja sobre os achados. Defina testes de qualidade a partir dos padrões encontrados.
Por que importa
Data profiling revela problemas antes que eles cheguem à produção: colunas com muitos nulos, cardinalidade inesperada (possível chave), tipos misturados e outliers. Em pipelines, perfilar dados de entrada ajuda a definir contratos de dados e testes de qualidade (por exemplo, em dbt ou Great Expectations).
O relatório completo mostra estatísticas para todas as colunas.
Perguntas frequentes
Qual o tamanho máximo de CSV suportado?
Depende da memória do navegador. Arquivos com dezenas de milhares de linhas são processados sem problema; para volumes muito grandes, amostre antes.
Como o tipo de cada coluna é inferido?
A ferramenta testa os valores contra inteiro, decimal, booleano e data; se a maioria corresponder, esse tipo é atribuído, senão a coluna é tratada como texto.
Em breve: espaço para comentários da comunidade. Enquanto isso, participe pelas discussões no GitHub.