Gender API
Cadastrar Grátis
Idioma expand_more

Detecção de gênero em massa: de dez mil nomes a 10,000,000

Envie o arquivo ou chame a API. De um jeito ou de outro você sabe o preço antes de começar, cada linha volta com a evidência por trás dela e sua planilha volta sendo a sua planilha.

Última revisão 2026-09-01 Escrito e mantido pelo time da Gender-API.com

A resposta curta

  • Até 10,000,000 linhas em um CSV, 100,000 em uma pasta de trabalho do Excel, ou 100 nomes por requisição de API sem limite para o número de requisições.
  • Uma consulta é um credit, comprado antes, a partir de €0.35 por 1.000 nomes. Você sabe o preço do trabalho inteiro antes de iniciá-lo, em nota fiscal com imposto, e os credits não expiram.
  • Sua pasta de trabalho é devolvida, não substituída: estilos, datas, fórmulas, células mescladas e as outras planilhas sobrevivem todas. As colunas novas são inseridas ao lado dos seus dados.
  • Cada linha carrega uma probabilidade e um número de amostras, então você pode aceitar automaticamente as linhas seguras e mandar só o resto para revisão.

Dois jeitos de fazer, e como escolher

Uma limpeza pontual e um banco de dados enriquecido continuamente são trabalhos diferentes. Os mesmos dados atendem aos dois, mas você não deveria usar o mesmo caminho para ambos.

Os dois caminhos para uma lista grande. O caminho do envio parte do seu arquivo CSV ou Excel, passa pelo assistente de envio onde você aponta a coluna com os nomes, segue para o processamento em segundo plano e sai como o mesmo arquivo com as colunas ga_ inseridas, avisado por e-mail. O caminho da API parte da sua aplicação, passa por um POST no endpoint em lote, até 100 nomes por requisição, e devolve JSON por nome. Os dois gastam um credit por consulta do mesmo saldo pré-pago.
Os dois caminhos e o saldo que compartilham.
Pergunta Fazer upload de um arquivo Chamar a API
Melhor para Uma lista que você já tem: um export do CRM, uma lista de inscritos em um evento, uma lista de e-mails Nomes que chegam continuamente: cadastros, pedidos, leads importados
Quem faz Qualquer pessoa que tenha o arquivo. Sem código. Alguém que programe, uma vez; depois roda sozinho
Limite de tamanho 10,000,000 linhas por CSV, 100,000 por pasta de trabalho do Excel 100 nomes por requisição, sem limite total
O que você recebe de volta O mesmo arquivo, com as colunas novas inseridas JSON por nome, para gravar onde você quiser
Informar o país Atribuir uma coluna de país no assistente Um país, uma locale ou um endereço IP por nome
Enquanto roda O processamento continua em segundo plano; você recebe um e-mail com o link de download quando termina Sincrônico: uma requisição, uma resposta
Custo Idêntico. Um credit por consulta nos dois casos, do mesmo saldo.

Quanto um trabalho grande custa de verdade

Cobrado por consulta, não por usuário nem por mês. Um nome resolvido é um credit, tenha passado por um arquivo ou pela API, e a tarifa melhora conforme o volume sobe.

Nomes Pacote publicado mais barato que cobre isso, líquido
10,000 €16.99
100,000 €99.00
500,000 €299
10,000,000 peça um orçamento

Duas coisas valem a pena antes de comprar, porque as duas reduzem o que você paga: tirar duplicados da lista — o mesmo nome duas vezes custa dois credits — e remover as linhas que você não precisa de fato genderizar. Um nome que você nunca envia é grátis, e num export real de clientes esses dois passos costumam remover uma parcela surpreendente do arquivo.

Os números atuais, todas as faixas e a opção por assinatura estão na página de preços. Maior que o maior pacote publicado? Fale com a gente: é uma conversa comum, não um caso especial.

Sua planilha volta sendo uma planilha

Essa é a parte que normalmente é feita mal, então vale ser específico. Não extraímos seus dados, atribuímos gênero e entregamos um arquivo novo. Abrimos sua pasta de trabalho, escrevemos as colunas novas dentro dela e devolvemos.

Uma planilha com as colunas originais ID, First Name, Last Name e Country intactas, e quatro colunas novas ao lado: ga_first_name, ga_gender, ga_accuracy e ga_samples. Katharina resolve como female com precisão 100 a partir de 88 samples, Barbara como female com 98 a partir de 3.709 samples e Andrea na Itália como male com 100 a partir de 65.535 samples.
Uma pasta de trabalho enriquecida. As colunas originais estão exatamente como estavam; as novas ficam ao lado.
  • Estilos, formatos de número e data, fórmulas e células mescladas são preservados: uma data continua uma data e uma fórmula continua uma fórmula.
  • Pastas com várias planilhas continuam com várias planilhas. O envio olha cada planilha, escolhe a primeira com dados e deixa você trocar para outra com um seletor.
  • A linha de cabeçalho não precisa ser a linha 1. Ela é detectada e, se a detecção errar, você clica na linha certa na prévia.
  • Texto livre acima da tabela, uma tabela que começa na coluna C, títulos de coluna faltando ou repetidos: tudo tratado, porque exports reais são assim.

As colunas adicionadas ao lado dos seus dados:

Coluna O que tem nela
ga_gender O resultado. Os rótulos são você que escolhe: male/female/unknown, m/f, 1/2, ou o que o seu CRM já espera.
ga_accuracy Quão desequilibrada é a distribuição observada para esse nome, como número inteiro de 0 a 100. (A API devolve a mesma coisa como probabilidade entre 0 e 1.) Coluna opcional.
ga_samples Em quantas observações isso se apoia. Coluna opcional, e a que torna o resultado auditável.
ga_first_name O nome que realmente resolvemos: útil quando a entrada era um nome completo ou um endereço de e-mail. Coluna opcional.

O assistente de envio, passo a passo. Teste com um arquivo.

Por que o número de amostras importa mais em escala

Com dez nomes você confere os resultados no olho. Com um milhão, não: a pergunta passa a ser em quais linhas você aceita agir sem conferir.

Como cada linha carrega uma probabilidade e o número de observações por trás dela, essa linha é você que traça. Uma comum: aceitar tudo de ga_accuracy 90 para cima com um número decente de amostras e separar o resto para uma pessoa ou uma saudação neutra. A alternativa — um único nível de confiança aplicado a todo o seu banco de dados, escolhido por outra pessoa — é como uma lista acaba se dirigindo errado às pessoas em escala.

Cinco linhas de um arquivo enriquecido medidas contra um limite de ga_accuracy 90 e ga_samples 50. Katharina, Barbara e Andrea passam e são usadas como estão. Uma linha com precisão 61 e 42 samples e uma linha sem resultado nenhum ficam abaixo e são separadas para revisão.
Limite a título de exemplo; as três primeiras linhas são os valores do arquivo acima.

Nomes que o banco de dados não consegue resolver deixam a coluna de gênero vazia em vez de preenchida com um chute. Com 9,124,598 nomes distribuídos por 192 países, essa é uma parcela pequena de uma lista comum, mas é uma parcela que você consegue ver.

Se sua lista abrange vários países, diga: o mesmo nome não é o mesmo gênero em todo lugar, e escrevemos isso separadamente.

Fazendo por código

Para enriquecimento contínuo, o endpoint em lote aceita até 100 nomes por requisição:

POST https://gender-api.com/v2/gender/by-first-name-multiple
[
    { "first_name": "Sandra", "country": "DE" },
    { "first_name": "Andrea", "country": "IT" }
]

Cada entrada responde de forma independente, com a própria probabilidade, o próprio número de amostras e o próprio país, então um lote é realmente um lote e não uma resposta única aplicada a vários nomes.

  • Clientes oficiais para PHP, Python, Node, Java, Go, Ruby, Rust, Perl e .NET.
  • Referência completa da v2, uma descrição OpenAPI e uma coleção do Postman.
  • Um guia de implementação pronto para uso em /skill.md, se você preferir passar o trabalho para um assistente de código.
  • Prefere trabalhar numa planilha ou num CRM? Existem integrações prontas para Excel, Google Sheets, Shopify, HubSpot, Salesforce, Zapier e outros.

As perguntas do setor de compras

Uma lista de nomes de clientes reais é dado pessoal, e um trabalho grande normalmente precisa da aprovação de alguém que vai perguntar exatamente isso:

  • Somos uma empresa alemã; todos os servidores ficam na Alemanha e os dados são processados dentro da UE.
  • Os arquivos enviados são armazenados criptografados e excluídos após dez dias, ou antes, se você mesmo os apagar.
  • Um acordo de processamento de dados pode ser solicitado na sua conta.
  • Os logs do servidor contêm o nome enviado e são mantidos por 14 dias, por razões contábeis.
  • Toda compra gera uma nota fiscal com imposto em ordem, e os números de IVA da UE são tratados corretamente.
  • Os credits de pacotes avulsos não expiram, então uma única limpeza grande não precisa de assinatura.

O quadro completo está no resumo de privacidade.

Perguntas frequentes

Quantos nomes posso processar de uma vez?

Até 10,000,000 linhas em um único arquivo CSV, até 100,000 linhas em uma única pasta de trabalho do Excel e 100 nomes por requisição pela API, sem limite para o número de requisições. Acima disso, divida o arquivo ou faça um laço na API.

Quanto custa um trabalho grande de detecção de gênero?

Uma consulta custa um credit, então o preço fica definido antes de você começar: o pacote publicado mais barato que cobre 500.000 nomes sai por €299 líquidos. Acima do maior pacote publicado passa a ser um orçamento em vez de preço de tabela. Você compra os credits antes, eles não expiram, e cada compra gera uma nota fiscal com imposto.

Preciso de alguém que programe?

Não. Você envia o arquivo, aponta a coluna que contém os nomes e baixa o arquivo pronto, sem uma linha de código. A API existe para o caso em que o enriquecimento precisa acontecer continuamente, e não uma única vez.

Meu arquivo do Excel volta intacto?

Sim. Estilos, formatos de número e data, fórmulas, células mescladas e todas as outras planilhas ficam como estavam; as colunas novas são inseridas na sua pasta de trabalho em vez de gerar um arquivo novo a partir dos seus dados.

O que acontece com as linhas que o banco de dados não consegue resolver?

A coluna de gênero fica vazia e o número de amostras diz por quê. Nada é adivinhado para preencher uma lacuna, então você pode filtrar essas linhas e decidir o que fazer com elas em vez de descobrir os chutes depois.

Um envio em massa está em conformidade com o GDPR?

Somos uma empresa alemã, todos os servidores ficam na Alemanha e os dados são processados dentro da UE. Os arquivos enviados são armazenados criptografados e excluídos após dez dias, e você pode solicitar um acordo de processamento de dados na sua conta.

Posso testar antes de pagar?

Sim: toda conta inclui 100 consultas gratuitas por mês, o suficiente para rodar uma amostra da sua própria lista e conferir os resultados antes de comprar credits para o arquivo inteiro.

COMECE COM UMA AMOSTRA DA SUA PRÓPRIA LISTA

100 consultas gratuitas por mês, sem cartão de crédito: o suficiente para rodar um pedaço do arquivo real e conferir os resultados antes de pagar por tudo.

Bate-papo