Gerador de CSV de exemplo (dados fictícios)

Defina nomes e tipos de coluna (ID sequencial, nome completo, e-mail, data, números e mais) para gerar e baixar instantaneamente dados CSV fictícios para testes e QA.

Tipos de dados suportados

Tipo Exemplo de saída
ID sequencial 1, 2, 3, ... ou uma sequência com prefixo como USR-0001
Nome completo Nomes fictícios que misturam estilos japoneses e ocidentais, ex.: Taro Yamada, Emma Smith
Endereço de e-mail [email protected] (derivado automaticamente do nome gerado)
Número de telefone Um formato de celular japonês como 090-1234-5678
Data Uma data aleatória dentro do intervalo escolhido, no formato AAAA-MM-DD
Inteiro Um número inteiro aleatório dentro do intervalo mínimo/máximo escolhido
Decimal (preço, etc.) Um decimal aleatório dentro do intervalo escolhido, arredondado para 2 casas
Booleano true/false (os rótulos podem ser personalizados)
Texto livre Uma frase de preenchimento como "Lorem ipsum dolor sit amet."

Gerar dados CSV de amostra

O desenvolvimento e os testes exigem **dados com aspecto convincente.** Usar dados de produção tal qual convém evitar quando há informação pessoal envolvida, e escrever nem que sejam dez linhas à mão é maçador. Indique aqui os nomes das colunas e os seus tipos e esta ferramenta gera um CSV fictício para testes e controlo de qualidade, pronto a descarregar de imediato.

**Poder especificar um tipo é o que dá sentido à ferramenta.** Um ficheiro preenchido com a mesma cadeia em toda a parte não testa nem a ordenação nem a procura. Como pode escolher identificadores sequenciais, nomes, endereços de correio, datas e números coluna a coluna, obtém **um ficheiro cuja distribuição se assemelha à de dados reais.** Tudo é gerado no seu navegador e nada é enviado para um servidor. Os nomes e endereços produzidos são fictícios e não guardam relação com pessoa real alguma.

Como gerar um CSV fictício

  1. Defina as colunas Acrescente tantos pares de nome de coluna e tipo de dados quantos precisar.
  2. Escolha o tipo de dados Opte entre identificador sequencial, nome, correio, data, número e outros. **Cada coluna admite um tipo distinto.**
  3. Ajuste as opções Alguns tipos permitem precisar um intervalo ou um formato.
  4. Indique o número de linhas Introduza tantas linhas quantas precisar.
  5. Descarregue o ficheiro O CSV gerado serve como dados de teste tal qual.

Dicas para aproveitar melhor

  • Informe qualquer número no campo de semente para reproduzir sempre os mesmos dados fictícios a partir das mesmas colunas; útil ao compartilhar um relatório de bug ou um fixture de testes automatizados.
  • O CSV gerado segue o padrão RFC 4180: valores contendo vírgulas, quebras de linha ou aspas duplas são corretamente colocados entre aspas e escapados.
  • A coluna de e-mail é derivada automaticamente de uma coluna de nome completo posicionada antes dela na mesma linha, então combiná-las produz dados internamente consistentes.
  • Todo o processamento ocorre inteiramente no navegador e nada é enviado a um servidor: são dados totalmente fabricados, sem nenhuma informação pessoal real.
  • O número de linhas é limitado a 10.000 para evitar travamentos no navegador. Se precisar de mais, fixe a semente e gere em lotes, depois combine os arquivos.

Situações em que ajuda

Testar uma funcionalidade de importação

**Elimina a necessidade de usar dados de produção**, evitando o risco que acarreta lidar com informação pessoal.

Verificar o comportamento do desenho

Veja se a apresentação aguenta perante nomes longos e caracteres pouco habituais.

Medir o desempenho

Gerar um número maior de linhas permite cronometrar como o sistema responde a volumes grandes.

Preparar um ambiente de demonstração

Encha com dados convincentes os ecrãs que mostrará numa reunião comercial ou numa revisão.

Termos de dados de teste

Dados fictícios
Dados criados para testar, não retirados da realidade. **Os valores são fictícios e alheios a qualquer pessoa real.**
CSV
Um formato de texto separado por vírgulas que a maioria das folhas de cálculo e bases de dados sabe ler.
Identificador sequencial
Um inteiro que conta a partir de um, usado amiúde em vez de uma chave primária.
Valores limite
Valores nos extremos — comprimento máximo, número mínimo — onde os defeitos costumam aflorar. **Prepare-os à parte; os dados fictícios por si só não os cobrem.**
Mascaramento
Ocultar partes dos dados de produção para os poder usar. É uma alternativa a gerar dados fictícios, não uma variante.
Codificação de caracteres
Confundir UTF-8 com Shift_JIS é a causa principal de texto ilegível nos ficheiros CSV.

Perguntas frequentes

Não, nenhuma. Nomes, e-mails e números de telefone são combinados mecanicamente a partir de uma lista de nomes de teste e de domínios/formatos fictícios; nada corresponde a uma pessoa real.

Até 10.000 linhas por geração, para evitar que o navegador trave. Se precisar de mais, fixe o valor da semente e gere em vários lotes, depois combine os arquivos resultantes.

A semente é o número inicial do gerador de números pseudoaleatórios. Usar a mesma semente com as mesmas colunas sempre produz a mesma sequência de dados fictícios. Isso é útil sempre que você precisa de aleatoriedade que ainda seja reproduzível, como ao compartilhar passos para reproduzir um bug ou comparar com um valor esperado fixo em um teste.

Alguns primeiros nomes são transliterações romanizadas de nomes japoneses (por exemplo, Taro, Hanako), mas o gerador ainda não produz nomes em kanji ou hiragana. Já os nomes de coluna e os rótulos booleanos aceitam qualquer texto livre, incluindo japonês.

O arquivo baixado é codificado em UTF-8. Abri-lo diretamente no Excel pode exibir caracteres estranhos dependendo das configurações regionais; recomenda-se usar a aba "Dados" do Excel e importar "De Texto/CSV", indicando explicitamente UTF-8 como origem do arquivo.
Tool-kun

Curiosidade — Por que os testes precisam de dados fictícios "com semente"

Usar dados fictícios em vez de registros reais é prática comum no desenvolvimento de software, por dois motivos principais: proteger informações pessoais (evitando dados reais de clientes em ambientes de desenvolvimento ou teste) e poder criar livremente casos-limite e entradas incomuns sob demanda. É exatamente por isso que bibliotecas como Faker do Ruby, Faker do Python e @faker-js/faker do JavaScript são tão utilizadas.

Por outro lado, dados fictícios totalmente aleatórios têm uma fraqueza: não são reproduzíveis. Quando um teste falha de forma intermitente, fica difícil saber se a causa é um bug real de lógica ou apenas um valor incomum que foi gerado por acaso naquele momento. Um gerador de números pseudoaleatórios com semente (seeded PRNG) resolve isso: dada a mesma semente, ele sempre produz exatamente a mesma sequência de números — e, portanto, os mesmos dados fictícios — tornando bugs muito mais fáceis de reproduzir e resultados de teste mais fáceis de verificar.

Esta ferramenta utiliza o mulberry32, um algoritmo capaz de gerar sequências pseudoaleatórias de boa qualidade com pouquíssimo processamento, sendo uma escolha leve e popular em JavaScript. Não é adequado para uso criptográfico, mas é exatamente o tipo de algoritmo indicado para geração de dados de teste, em que ser determinístico e rápido importa muito mais do que a imprevisibilidade criptográfica.