Pular para o conteúdo principal

CSV Profiler

Perfil de arquivo CSV coluna por coluna — tipo inferido, contagens vazias e distintas, intervalo de valores, média e valor mais comum — mais um relatório de qualidade de dados que nomeia linhas malformadas, linhas duplicadas, colunas de tipo misto e chaves primárias candidatas. Detecta o delimitador automaticamente e funciona totalmente no seu navegador.

Entrada

Drop a file or browse
One file · text
Ou

Opções

Com isso desativado, as colunas são perfiladas como "Coluna 1", "Coluna 2", … e a primeira linha conta como dados.

Também faz um campo contendo apenas espaços ser contado como vazio, que é geralmente o que você quer ao perfilar uma exportação.

Saída

Visão geral do conjunto de dados
MétricaValor
No data yet
Perfil da coluna
#ColunaTipoNão-vazioVazioDistintoIntervaloMédiaMais comum
No data yet

Intervalo e Média são valores para colunas numéricas, mais antigo → mais recente para datas, e comprimentos de caracteres para todo o resto.

Relatório de qualidade de dados
 
Isso foi útil?

Mais formas de usar esta ferramenta

API REST

curl -X POST https://api.iotools.cloud/v1/tool/csv-profiler \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "csvSource": "id,name,signup_date,plan,seats,mrr,churned\n1,Acm…",
    "delimiter": "auto",
    "firstRowHeaders": "true",
    "trimValues": "true"
  }'

Troque pela sua própria chave, da sua conta. Os campos da ferramenta viram o corpo da requisição — sem envelope.

Peça a um agente de IA

Use the IOTools `csv-profiler` tool (CSV Profiler) on this input:

YOUR_INPUT_HERE

Cole isto em qualquer agente conectado ao servidor MCP do IOTools e depois adicione sua entrada.

Widget para incorporar

<iframe
  src="https://iotools.cloud/embed/csv-profiler/"
  width="100%" height="520" frameborder="0" scrolling="no" loading="lazy"
  title="CSV Profiler — iotools.cloud"
  sandbox="allow-scripts allow-forms allow-same-origin allow-downloads allow-popups allow-popups-to-escape-sandbox"
  allow="clipboard-write"
  style="width:100%;border:1px solid #e5e7eb;border-radius:12px;overflow:hidden"></iframe>
<script src="https://iotools.cloud/embed.js" async></script>

Coloque isso na sua própria página — grátis, sem chave, só um link de volta.

Custo por chamada de API/MCPA partir de 5 créditos
Precisa de mais créditos?Ver preços

Também disponível via

Guias

Cole um CSV — ou solte o arquivo — e obtenha um perfil coluna por coluna do que realmente está nele antes de importar em qualquer lugar. Este profiler de CSV online gratuito infere o tipo de cada coluna, conta valores vazios e distintos, relata o intervalo de valores e a média, nomeia o valor mais comum, e então escreve um relatório de qualidade de dados em linguagem simples nomeando linhas malformadas, linhas duplicadas, colunas de tipo misto e chaves primárias candidatas. O delimitador é detectado automaticamente e nada é carregado.

Como usar

  1. Cole seu CSV em Entrada CSV, ou envie um arquivo .csv.
  2. Deixe Delimitador em Detectar automaticamente a menos que o palpite esteja errado — vírgula, ponto e vírgula, tabulação e barra também podem ser forçados.
  3. Deixe Primeira linha contém cabeçalhos ativado se seu arquivo tiver uma linha de cabeçalho; com ele desativado, as colunas são perfiladas como "Coluna 1", "Coluna 2", … e a primeira linha conta como dados.
  4. Leia a Visão geral do conjunto de dados para forma e problemas de nível de arquivo, o Perfil da coluna para estatísticas por coluna, e o Relatório de qualidade de dados para as coisas específicas que valem a pena corrigir.

Ambas as tabelas podem ser copiadas ou baixadas como CSV, então um perfil pode ir direto para um ticket ou uma planilha.

O que significa cada coluna do perfil?

Tipo é inferido de cada valor não-vazio: integer, number, boolean, date, text, ou mixed quando os valores não concordam (uma coluna de 1 e 1.5 é number, não mixed — inteiros se expandem). Não-vazio e Vazio contam células preenchidas e em branco. Distinto é o número exato de valores diferentes, não uma estimativa. Intervalo e Média são o mínimo/máximo numérico e média para colunas numéricas, valor mais antigo → mais recente para datas, e comprimentos de caracteres para texto. Mais comum mostra o valor mais frequente e quantas vezes ocorre — em branco quando nenhum valor se repete.

O que é uma linha "malformada"?

Uma linha com um número diferente de campos do cabeçalho. Quase sempre significa um delimitador ou quebra de linha dentro de um valor sem aspas, que é exatamente o tipo de bug que muda colunas após uma importação. O resumo os conta e o relatório de qualidade os nomeia.

Por que sinaliza "chave primária candidata"?

Uma coluna em que cada linha contém um valor diferente e não-vazio é um identificador único natural — que vale a pena saber antes de você projetar uma tabela ou uma junção. Só é relatado em arquivos com pelo menos cinco linhas, pois a exclusividade em três linhas geralmente é uma coincidência.

O parser manipula campos entre aspas?

Sim. Valores entre aspas contendo o delimitador, quebras de linha incorporadas e escapes duplos "" são todos analisados corretamente — este é um analisador real estilo RFC 4180, não uma divisão em vírgulas. Isso importa para profiling, porque uma divisão ingênua relataria linhas malformadas que não existem.

Meus dados são privados?

Completamente. Parsing e profiling são executados no seu navegador; o arquivo nunca é carregado, registrado ou armazenado. Esse é o ponto de perfilar uma exportação de cliente aqui em vez de em uma ferramenta de dados hospedada.

O que devo fazer com os resultados?

Se uma coluna está principalmente vazia ou tipo misto, limpe antes de importar. Se você precisar apenas de algumas colunas, use o CSV Column Extractor. Para remodelar o arquivo para outro sistema, tente CSV to JSON ou CSV to SQL; para arrumar a própria formatação, use o CSV Formatter.

csvprofilerdataqualitystatisticsanalysisspreadsheet

Ama as ferramentas? Livre-se dos anúncios.

Um único pagamento remove todos os anúncios da sua conta, para sempre. Sem assinatura, sem rastreamento.