Massen-Geschlechtsbestimmung: von zehntausend Namen bis 10,000,000
Lade die Datei hoch oder rufe die API auf. So oder so kennst du den Preis, bevor du anfängst, jede Zeile kommt mit ihren Belegen zurück, und deine Tabelle kommt als deine Tabelle zurück.
Die kurze Antwort
- Bis zu 10,000,000 Zeilen in einer CSV, 100,000 in einer Excel-Datei oder 100 Namen pro API-Anfrage, ohne Obergrenze für die Zahl der Anfragen.
- Eine Abfrage ist ein Credit, vorab gekauft — ab €0.35 pro 1.000 Namen. Du kennst den Preis des ganzen Auftrags, bevor du ihn startest, auf einer Rechnung mit MwSt., und Credits verfallen nicht.
- Deine Datei kommt zurück, sie wird nicht ersetzt: Formatierungen, Datumsangaben, Formeln, verbundene Zellen und die anderen Arbeitsblätter bleiben alle erhalten. Die neuen Spalten werden neben deinen Daten eingefügt.
- Jede Zeile trägt eine Wahrscheinlichkeit und eine Stichprobengröße. So kannst du die sicheren Zeilen automatisch übernehmen und nur den Rest zur Prüfung schicken.
Zwei Wege — und wie du wählst
Eine einmalige Bereinigung und eine laufend angereicherte Datenbank sind zwei verschiedene Aufgaben. Dieselben Daten beantworten beide, aber du solltest nicht für beide denselben Weg nehmen.
| Frage | Datei hochladen | API aufrufen |
|---|---|---|
| Am besten für | Eine Liste, die du jetzt hast — ein CRM-Export, eine Teilnehmerliste, eine Mailingliste | Namen, die laufend hereinkommen — Anmeldungen, Bestellungen, importierte Leads |
| Wer macht es | Jede und jeder mit der Datei. Ohne Code. | Einmal die Entwicklung — danach läuft es allein |
| Größenbeschränkung | 10,000,000 Zeilen pro CSV, 100,000 pro Excel-Datei | 100 Namen pro Anfrage, keine Gesamtgrenze |
| Was du zurückbekommst | Dieselbe Datei, mit eingefügten neuen Spalten | JSON pro Name, das du schreiben kannst, wohin du willst |
| Das Land mitgeben | Im Assistenten eine Länderspalte zuweisen | Ein Land, eine Locale oder eine IP-Adresse pro Name |
| Während es läuft | Die Verarbeitung läuft im Hintergrund weiter; wenn sie fertig ist, bekommst du eine E-Mail mit dem Download-Link | Synchron — eine Anfrage, eine Antwort |
| Kosten | Identisch. So oder so ein Credit pro Abfrage, aus demselben Guthaben. | |
Was ein großer Auftrag tatsächlich kostet
Abgerechnet pro Abfrage, nicht pro Nutzer und nicht pro Monat. Ein aufgelöster Name ist ein Credit, ob über eine Datei oder die API, und der Preis pro Name sinkt mit der Menge.
| Namen | Günstigstes veröffentlichtes Paket, das das abdeckt, netto |
|---|---|
| 10,000 | €16.99 |
| 100,000 | €99.00 |
| 500,000 | €299 |
| 10,000,000 | frag uns nach einem Angebot |
Zwei Dinge lohnen sich vor dem Kauf, weil beide senken, was du zahlst: Dubletten entfernen — derselbe Vorname zweimal kostet zwei Credits — und die Zeilen streichen, für die du das Geschlecht gar nicht brauchst. Ein Name, den du nie schickst, ist kostenlos, und bei einem echten Kundenexport entfernen diese zwei Schritte oft einen überraschend großen Teil der Datei.
Aktuelle Zahlen, alle Stufen und die Abo-Variante findest du auf der Preisseite. Größer als das größte veröffentlichte Paket? Frag uns — das ist ein normales Gespräch und kein Sonderfall.
Deine Tabelle kommt als Tabelle zurück
Das ist der Teil, der üblicherweise schlecht gemacht wird, deshalb hier genau: Wir lesen deine Daten nicht heraus, bestimmen das Geschlecht und geben dir eine neue Datei. Wir öffnen deine Datei, schreiben die neuen Spalten hinein und geben sie zurück.
- Formatierungen, Zahlen- und Datumsformate, Formeln und verbundene Zellen bleiben erhalten — ein Datum bleibt ein Datum, und eine Formel ist weiter eine Formel.
- Dateien mit mehreren Arbeitsblättern behalten alle Arbeitsblätter. Der Upload schaut jedes Blatt durch, nimmt das erste mit Daten und lässt dich über eine Auswahl auf ein anderes wechseln.
- Die Kopfzeile muss nicht Zeile 1 sein. Sie wird erkannt, und wenn die Erkennung falsch liegt, klickst du in der Vorschau die richtige Zeile an.
- Freier Text über der Tabelle, eine Tabelle, die in Spalte C beginnt, lückenhafte oder doppelte Spaltentitel: alles abgedeckt, weil echte Exporte genau so aussehen.
Die Spalten, die neben deinen Daten hinzukommen:
| Spalte | Was darin steht |
|---|---|
ga_gender |
Das Ergebnis. Die Bezeichnungen wählst du selbst — male/female/unknown, m/w, 1/2 oder was dein CRM ohnehin erwartet. |
ga_accuracy |
Wie einseitig die beobachtete Verteilung für diesen Namen ist, als ganze Zahl von 0 bis 100. (Die API gibt dasselbe als Wahrscheinlichkeit zwischen 0 und 1 zurück.) Optionale Spalte. |
ga_samples |
Auf wie vielen Beobachtungen das beruht. Optionale Spalte — und die, die das Ergebnis überprüfbar macht. |
ga_first_name |
Der Vorname, den wir tatsächlich aufgelöst haben — nützlich, wenn die Eingabe ein vollständiger Name oder eine E-Mail-Adresse war. Optionale Spalte. |
Der Upload-Assistent, Schritt für Schritt. Probier ihn mit einer Datei.
Warum die Stichprobengröße bei großen Mengen wichtiger wird
Bei zehn Namen kannst du die Ergebnisse überfliegen. Bei einer Million nicht — die Frage wird also, bei welchen Zeilen du ungeprüft handeln willst.
Weil jede Zeile eine Wahrscheinlichkeit und die Zahl der Beobachtungen dahinter mitbringt, ziehst du diese Grenze selbst. Eine gängige: alles ab ga_accuracy 90 mit ordentlicher Stichprobe übernehmen, den Rest für einen Menschen oder eine neutrale Anrede zurückhalten. Die Alternative — ein einziges Konfidenzniveau für deine ganze Datenbank, von jemand anderem gewählt — ist der Weg, auf dem eine Liste am Ende viele Menschen falsch anspricht.
Namen, die die Datenbank nicht auflösen kann, lassen die Geschlechtsspalte leer, statt sie mit einer Vermutung zu füllen. Mit 9,124,598 Vornamen aus 192 Ländern ist das bei einer gewöhnlichen Liste ein kleiner Anteil — aber einer, den du zu sehen bekommst.
Wenn deine Liste mehrere Länder umfasst, sag es — derselbe Name ist nicht überall dasselbe Geschlecht, und das haben wir separat aufgeschrieben.
Der Weg über Code
Für laufende Anreicherung nimmt der Batch-Endpoint bis zu 100 Namen pro Anfrage:
POST https://gender-api.com/v2/gender/by-first-name-multiple
[
{ "first_name": "Sandra", "country": "DE" },
{ "first_name": "Andrea", "country": "IT" }
]
Jeder Eintrag wird eigenständig beantwortet, mit eigener Wahrscheinlichkeit, eigener Stichprobengröße und eigenem Land — ein Batch ist also wirklich ein Batch und nicht eine Antwort, die auf mehrere Namen angewendet wird.
- Offizielle Clients für PHP, Python, Node, Java, Go, Ruby, Rust, Perl und .NET.
- Vollständige v2-Referenz, eine OpenAPI-Beschreibung und eine Postman-Collection.
- Eine prompt-fertige Anleitung unter /skill.md, falls du die Arbeit lieber einem Coding-Assistenten übergibst.
- Du arbeitest lieber in einer Tabelle oder im CRM? Es gibt fertige Integrationen für Excel, Google Sheets, Shopify, HubSpot, Salesforce, Zapier und mehr.
Die Fragen aus dem Einkauf
Eine Liste mit echten Kundennamen ist personenbezogene Daten, und ein großer Auftrag braucht meist die Freigabe von jemandem, der genau das fragt:
- Wir sind ein deutsches Unternehmen; alle Server stehen in Deutschland und die Daten werden innerhalb der EU verarbeitet.
- Hochgeladene Dateien werden verschlüsselt gespeichert und nach zehn Tagen gelöscht — früher, wenn du sie selbst löschst.
- Einen Auftragsverarbeitungsvertrag kannst du in deinem Konto anfordern.
- Server-Logs enthalten den übermittelten Namen und werden aus Abrechnungsgründen 14 Tage aufbewahrt.
- Jeder Kauf erzeugt eine korrekte Rechnung mit MwSt., und EU-Umsatzsteuer-IDs werden richtig behandelt.
- Credits aus Einmalpaketen verfallen nicht, eine einzelne große Bereinigung braucht also kein Abo.
Das vollständige Bild steht in der Datenschutzübersicht.
Häufige Fragen
Wie viele Namen kann ich auf einmal verarbeiten?
Bis zu 10,000,000 Zeilen in einer einzelnen CSV-Datei, bis zu 100,000 Zeilen in einer einzelnen Excel-Datei und 100 Namen pro Anfrage über die API — ohne Obergrenze für die Zahl der Anfragen. Wird es mehr, teile die Datei auf oder rufe die API in einer Schleife auf.
Was kostet ein großer Auftrag zur Geschlechtsbestimmung?
Eine Abfrage kostet ein Credit, der Preis steht also fest, bevor du anfängst: Das günstigste veröffentlichte Paket für 500.000 Namen liegt bei €299 netto. Oberhalb des größten veröffentlichten Pakets wird daraus ein Angebot statt eines Listenpreises. Du kaufst die Credits vorab, sie verfallen nicht, und jeder Kauf erzeugt eine Rechnung mit MwSt.
Brauche ich eine Entwicklerin oder einen Entwickler?
Nein. Datei hochladen, auf die Spalte mit den Vornamen zeigen, fertige Datei herunterladen — ohne eine Zeile Code. Die API ist für den Fall gedacht, dass die Anreicherung laufend statt einmalig passieren muss.
Kommt meine Excel-Datei unversehrt zurück?
Ja. Formatierungen, Zahlen- und Datumsformate, Formeln, verbundene Zellen und alle weiteren Arbeitsblätter bleiben, wie sie waren; die neuen Spalten werden in deine Datei eingefügt, statt aus deinen Daten eine neue Datei zu erzeugen.
Was passiert mit Zeilen, die die Datenbank nicht auflösen kann?
Die Geschlechtsspalte bleibt leer, und die Stichprobengröße sagt dir, warum. Es wird nichts geraten, um eine Lücke zu füllen — du kannst diese Zeilen also filtern und selbst entscheiden, statt die Vermutungen später zu entdecken.
Ist ein Massen-Upload DSGVO-konform?
Wir sind ein deutsches Unternehmen, alle Server stehen in Deutschland und die Daten werden innerhalb der EU verarbeitet. Hochgeladene Dateien werden verschlüsselt gespeichert und nach zehn Tagen gelöscht, und einen Auftragsverarbeitungsvertrag kannst du in deinem Konto anfordern.
Kann ich es vor dem Kauf ausprobieren?
Ja — jedes Konto enthält 100 kostenlose Abfragen pro Monat. Das genügt, um eine Stichprobe deiner eigenen Liste laufen zu lassen und die Ergebnisse zu prüfen, bevor du Credits für die ganze Datei kaufst.
FANG MIT EINER STICHPROBE DEINER LISTE AN
100 kostenlose Abfragen pro Monat, ohne Kreditkarte — genug, um einen Ausschnitt der echten Datei laufen zu lassen und die Ergebnisse zu prüfen, bevor du für alles bezahlst.
CSV- oder Excel-Datei hochladen · API-Dokumentation · Nach größeren Mengen fragen