Kit de ferramentas CSV
FormataçãoAnalise, alinhe e pré-visualize CSV/TSV com delimitadores e aspas personalizados, ou converta entre CSV e JSON. Ordene e elimine duplicatas por coluna com papaparse.
URLs remotas não são buscadas; cole seu JSON diretamente.
A Europa costuma usar ; como separador CSV.
Nesta página
O que é um kit de ferramentas CSV?#
O CSV é o formato de denominador comum mais baixo para dados tabulares — toda a folha de cálculo, todo o assistente de importação de base de dados, e toda a ferramenta de análise consegue lê-lo, e quase nenhum concorda nos detalhes. O delimitador é vírgula ou ponto e vírgula? A primeira linha tem cabeçalhos? Os valores estão entre " ou '? Um arquivo que abre perfeitamente numa ferramenta pode chegar corrompido noutra, simplesmente porque as predefinições diferem. Um kit de ferramentas CSV existe para tornar essas escolhas explícitas e para refazer um arquivo de modo a que faça o que se precisa.
Esta página faz quatro trabalhos, todos movidos pelo papaparse. Alinhar analisa o arquivo e preenche cada célula até à largura da sua coluna, produzindo uma grelha monoespaçada e alinhada por colunas que se pode colar diretamente numa revisão de código, num README, ou num relatório de bug — o tipo de disposição que faz uma linha desalinhada saltar à vista instantaneamente. Pré-visualizar analisa e renderiza a tabela na própria página, para que se possa dar uma vista de olhos aos dados antes de fazer seja o que for com eles. CSV → JSON transforma linhas num array JSON (de objetos quando há cabeçalho, de arrays caso contrário). JSON → CSV vai no outro sentido, pegando num array JSON e emitindo CSV. Por cima de tudo isto, pode ordenar por qualquer coluna, eliminar duplicatas de linhas completas, trocar o delimitador (vírgula, ponto e vírgula, tabulação ou um carácter personalizado), e escolher o carácter de aspa — os botões exatos que decidem se o arquivo sobrevive à próxima ferramenta no pipeline.
Como usar#
- Cole o seu CSV (ou JSON, no modo JSON → CSV) no painel Entrada à esquerda. O marcador de posição mostra a forma esperada; Exemplo carrega um pequeno conjunto de dados.
- Escolha um botão de Modo: Alinhar, Pré-visualizar ou JSON. Quando JSON está selecionado, aparece um segundo grupo de botões para a direção — CSV → JSON ou JSON → CSV.
- Defina as opções estruturais na barra de ferramentas:
- Delimitador — vírgula, ponto e vírgula, tabulação ou personalizado (aparece um campo de um carácter para o valor personalizado, predefinido a
|). - Aspa — dupla (
") ou simples ('). - Linha de cabeçalho — marque quando a linha 1 tem nomes de colunas; desmarque para dados sem cabeçalho. O modo de cabeçalho orienta tanto a análise como a forma da saída JSON.
- Delimitador — vírgula, ponto e vírgula, tabulação ou personalizado (aparece um campo de um carácter para o valor personalizado, predefinido a
- Opcionalmente arrume os dados: escolha uma coluna de Ordenar por (povoada a partir do seu cabeçalho, ou um índice numérico para entrada sem cabeçalho), escolha Ordem crescente ou decrescente, e marque Eliminar duplicatas para largar linhas totalmente duplicadas.
- Leia o resultado no painel Saída (ou na grelha de pré-visualização no modo Pré-visualizar). O cabeçalho mostra o tamanho da saída e a contagem de linhas; use Copiar para o recolher. Limpar repõe ambos os painéis.
Se uma linha tem o número errado de campos, ou a entrada é malformada, a barra de estado reporta o número da linha para que se possa corrigir a fonte em vez de adivinhar.
Principais funcionalidades#
- Saída alinhada por colunas. O modo Alinhar preenche cada célula até ao valor mais longo da sua coluna, pelo que um CSV que parecia uma parede de vírgulas alinha-se subitamente — inestimável para detetar uma linha a quem falta um campo.
- Ambas as direções para JSON. CSV → JSON produz um array de objetos (com cabeçalho) ou um array de arrays (sem cabeçalho). JSON → CSV aceita qualquer das formas de volta.
- Conhecedor de delimitadores. Alterne entre vírgula, ponto e vírgula (comum em localidades europeias onde a vírgula é o separador decimal), tabulação (TSV), ou um carácter personalizado. A pista por baixo da barra de ferramentas lembra-lhe porque existem os pontos e vírgula.
- Ordenar e eliminar duplicatas. Ordenar numericamente quando ambos os valores parecem números, caso contrário lexicograficamente. Eliminar duplicatas remove repetições exatas de linha completa (a linha de cabeçalho é sempre mantida).
- Pré-visualização segura. A grelia de pré-visualização é construída com APIs de DOM seguras — só
textContent, nuncainnerHTMLdos seus dados — pelo que mesmo um CSV cheio de tags<script>renderiza como texto inerte. - Estritamente no lado do cliente, com um Web Worker para entradas acima de 1 MB.
Exemplo prático#
Uma pequena lista colada com uma linha duplicada e um cabeçalho:
Entrada:
name,role,city
Ada,Engineer,London
Lin,Designer,Taipei
Ada,Engineer,London
Sam,Manager,Berlin
A terceira linha repete Ada exatamente. Clique em Alinhar com delimitador Vírgula, cabeçalho ativado, depois marque Eliminar duplicatas:
name role city
Ada Engineer London
Lin Designer Taipei
Sam Manager Berlin
Cada coluna preenchida até ao seu valor mais largo, pelo que as três linhas alinham e a Ada duplicada desaparece — a barra de estado reporta uma linha removida. Agora mude o modo para JSON (CSV → JSON) com as mesmas opções:
[
{ "name": "Ada", "role": "Engineer", "city": "London" },
{ "name": "Lin", "role": "Designer", "city": "Taipei" },
{ "name": "Sam", "role": "Manager", "city": "Berlin" }
]
A linha de cabeçalho tornou-se chaves de objeto; cada linha de dados restante tornou-se um objeto. Ordenar por role reordenaria as linhas lexicograficamente; ordenar por uma coluna numérica ordenaria por valor.
FAQ#
Quando devo usar ponto e vírgula em vez de vírgula?#
Quando os dados contêm vírgulas como parte dos valores e se está numa localidade (grande parte da Europa, América Latina) onde a vírgula é o separador decimal — 3,14 é aí um único número, não dois campos. O Excel nessas localidades exporta CSV com pontos e vírgula por padrão. Se um arquivo abre com tudo amontoado na coluna A, o delimitador é quase certamente o errado; mude para ponto e vírgula e realinhe.
O que é que Eliminar duplicatas realmente compara?#
Compara linhas inteiras para igualdade exata, depois de o cabeçalho ter sido separado. Duas linhas são duplicadas apenas se todos os campos corresponderem, célula a célula. A linha de cabeçalho nunca é considerada duplicada e é sempre mantida. Correspondências parciais (mesmo nome, cidade diferente) não contam como duplicadas.
Como é que o CSV → JSON decide entre objetos e arrays?#
Se Linha de cabeçalho está marcado, cada linha de dados torna-se um objeto cujas chaves são os nomes do cabeçalho. Se está desmarcado, cada linha torna-se um array de strings, etiquetado Col 1, Col 2 e por aí apenas na pré-visualização — a saída JSON é um array simples de arrays. Marque a opção de cabeçalho quando a linha 1 é efetivamente nomes de colunas; desmarque-a para grelhas numéricas em bruto.
Os meus dados são enviados para algum lado?#
Não. A análise e a desserialização correm ambas no seu navegador através do papaparse, empacotado com a página. Ficheiros acima de 1 MB são tratados num Web Worker para a interface se manter responsiva, mas os dados nunca saem do seu dispositivo.