Masowe rozpoznawanie płci: od dziesięciu tysięcy imion do 10,000,000
Wgraj plik albo wywołaj API. Tak czy inaczej znasz cenę przed startem, każdy wiersz wraca z dowodami, a Twój arkusz wraca jako Twój arkusz.
Krótka odpowiedź
- Do 10,000,000 wierszy w jednym CSV, 100,000 w jednym arkuszu Excela albo 100 imion na zapytanie API, bez limitu liczby zapytań.
- Jedno wyszukanie to jeden credit, kupiony z góry — od €0.35 za 1000 imion. Cenę całego zlecenia znasz przed jego uruchomieniem, na fakturze VAT, a credity nie tracą ważności.
- Twój plik wraca, nie jest podmieniany: formatowanie, daty, formuły, scalone komórki i pozostałe arkusze przetrwają w całości. Nowe kolumny są wpisywane obok Twoich danych.
- Każdy wiersz nosi prawdopodobieństwo i liczbę próbek, więc pewne wiersze możesz przyjąć automatycznie, a do weryfikacji wysłać tylko resztę.
Dwa sposoby i jak wybrać
Jednorazowe porządkowanie i baza wzbogacana na bieżąco to dwa różne zadania. Te same dane odpowiadają na oba, ale nie powinieneś używać do nich tej samej drogi.
| Pytanie | Prześlij plik | Wywołanie API |
|---|---|---|
| Najlepsze do | Listy, którą masz teraz: eksport z CRM, lista zapisanych na wydarzenie, lista mailingowa | Imion pojawiających się na bieżąco: rejestracje, zamówienia, importowane leady |
| Kto to robi | Każdy, kto ma plik. Bez kodu. | Programista, raz — potem działa samo |
| Limit wielkości | 10,000,000 wierszy na CSV, 100,000 na arkusz Excela | 100 imion na zapytanie, bez limitu łącznego |
| Co dostajesz | Ten sam plik z wpisanymi nowymi kolumnami | JSON dla każdego imienia, do zapisania gdzie chcesz |
| Podanie kraju | Wskazanie kolumny z krajem w asystencie | Kraj, locale lub adres IP przy każdym imieniu |
| W trakcie | Przetwarzanie trwa w tle; po zakończeniu dostajesz e-mail z linkiem do pobrania | Synchronicznie: jedno zapytanie, jedna odpowiedź |
| Koszt | Identyczny. W obu przypadkach jeden credit za wyszukanie, z tego samego salda. | |
Ile naprawdę kosztuje duże zlecenie
Rozliczenie za wyszukanie, nie za użytkownika ani za miesiąc. Jedno rozstrzygnięte imię to jeden credit, niezależnie od tego, czy poszło plikiem czy przez API, a stawka poprawia się wraz z ilością.
| Imiona | Najtańsza opublikowana paczka, która to pokrywa, netto |
|---|---|
| 10,000 | €16.99 |
| 100,000 | €99.00 |
| 500,000 | €299 |
| 10,000,000 | poproś nas o wycenę |
Dwie rzeczy warto zrobić przed zakupem, bo obie obniżają rachunek: usunąć duplikaty z listy — to samo imię dwa razy kosztuje dwa credity — i wyrzucić wiersze, przy których płeć wcale nie jest Ci potrzebna. Imię, którego nigdy nie wyślesz, jest darmowe, a w prawdziwym eksporcie klientów te dwa kroki często usuwają zaskakująco dużą część pliku.
Aktualne kwoty, wszystkie progi i wariant abonamentowy znajdziesz na stronie cennika. Więcej niż największa opublikowana paczka? Zapytaj nas — to zwykła rozmowa, a nie przypadek specjalny.
Twój arkusz wraca jako arkusz
To ta część, którą zwykle robi się źle, więc powiedzmy dokładnie: nie wyciągamy Twoich danych, nie uzupełniamy płci na boku i nie oddajemy nowego pliku. Otwieramy Twój arkusz, wpisujemy do niego nowe kolumny i oddajemy go.
- Formatowanie, formaty liczb i dat, formuły oraz scalone komórki zostają zachowane — data pozostaje datą, a formuła nadal jest formułą.
- Pliki z wieloma arkuszami zachowują wszystkie arkusze. Wgrywanie przegląda każdy z nich, bierze pierwszy z danymi i pozwala przełączyć się na inny przez wybór arkusza.
- Wiersz nagłówka nie musi być wierszem 1. Jest wykrywany, a jeśli wykrycie się myli, klikasz właściwy wiersz w podglądzie.
- Swobodny tekst nad tabelą, tabela zaczynająca się w kolumnie C, brakujące lub powtórzone nagłówki kolumn: wszystko obsłużone, bo prawdziwe eksporty tak wyglądają.
Kolumny dodawane obok Twoich danych:
| Kolumna | Co w niej jest |
|---|---|
ga_gender |
Wynik. Etykiety wybierasz sam: male/female/unknown, m/k, 1/2 albo cokolwiek, czego i tak oczekuje Twój CRM. |
ga_accuracy |
Jak jednostronny jest zaobserwowany rozkład dla tego imienia, jako liczba całkowita od 0 do 100. (API zwraca to samo jako prawdopodobieństwo między 0 a 1.) Kolumna opcjonalna. |
ga_samples |
Na ilu obserwacjach to się opiera. Kolumna opcjonalna — i ta, która czyni wynik sprawdzalnym. |
ga_first_name |
Imię, które faktycznie rozpoznaliśmy — przydatne, gdy na wejściu było pełne imię i nazwisko albo adres e-mail. Kolumna opcjonalna. |
Asystent wgrywania, krok po kroku. Wypróbuj go na pliku.
Dlaczego liczba próbek waży więcej przy dużej skali
Przy dziesięciu imionach wyniki obejrzysz na oko. Przy milionie już nie, więc pytanie brzmi: na których wierszach zgodzisz się działać bez kontroli.
Ponieważ każdy wiersz nosi prawdopodobieństwo i liczbę obserwacji, tę granicę wyznaczasz sam. Typowa: przyjmować wszystko od ga_accuracy 90 w górę przy przyzwoitej liczbie próbek, resztę odłożyć dla człowieka albo dla neutralnego zwrotu. Alternatywa — jeden poziom pewności narzucony całej Twojej bazie, wybrany przez kogoś innego — to sposób, w jaki lista zaczyna masowo zwracać się do ludzi niewłaściwie.
Imiona, których baza nie potrafi rozstrzygnąć, zostawiają kolumnę z płcią pustą, a nie wypełnioną domysłem. Przy 9,124,598 imionach z 192 krajów to niewielka część zwykłej listy — ale część, którą możesz zobaczyć.
Jeśli Twoja lista obejmuje kilka krajów, powiedz to: to samo imię nie oznacza wszędzie tej samej płci, a opisaliśmy to osobno.
Wersja dla programistów
Do wzbogacania na bieżąco endpoint zbiorczy przyjmuje do 100 imion na zapytanie:
POST https://gender-api.com/v2/gender/by-first-name-multiple
[
{ "first_name": "Sandra", "country": "DE" },
{ "first_name": "Andrea", "country": "IT" }
]
Każdy wpis jest rozstrzygany niezależnie, z własnym prawdopodobieństwem, własną liczbą próbek i własnym krajem — paczka jest więc naprawdę paczką, a nie jedną odpowiedzią zastosowaną do kilku imion.
- Oficjalne klienty dla PHP, Python, Node, Java, Go, Ruby, Rust, Perl i .NET.
- Pełna dokumentacja v2, opis OpenAPI i kolekcja Postman.
- Gotowy do użycia przewodnik wdrożeniowy pod /skill.md, jeśli wolisz oddać zadanie asystentowi programistycznemu.
- Wolisz pracować w arkuszu albo w CRM? Są gotowe integracje dla Excela, Google Sheets, Shopify, HubSpot, Salesforce, Zapier i innych.
Pytania z działu zakupów
Lista prawdziwych imion klientów to dane osobowe, a duże zlecenie zwykle wymaga zgody kogoś, kto zapyta dokładnie o to:
- Jesteśmy niemiecką firmą; wszystkie serwery stoją w Niemczech, a dane są przetwarzane na terenie UE.
- Wgrane pliki są zapisywane w postaci zaszyfrowanej i usuwane po dziesięciu dniach — wcześniej, jeśli usuniesz je sam.
- Umowę o przetwarzaniu danych możesz zamówić w swoim koncie.
- Logi serwera zawierają przesłane imię i są przechowywane 14 dni, z powodów rozliczeniowych.
- Każdy zakup kończy się prawidłową fakturą VAT, a unijne numery VAT są obsługiwane poprawnie.
- Credity z paczek jednorazowych nie tracą ważności, więc jedno duże porządkowanie nie potrzebuje abonamentu.
Pełny obraz znajdziesz w przeglądzie prywatności.
Często zadawane pytania
Ile imion mogę przetworzyć jednorazowo?
Do 10,000,000 wierszy w jednym pliku CSV, do 100,000 wierszy w jednym arkuszu Excela i 100 imion na zapytanie przez API — bez limitu liczby zapytań. Powyżej tego podziel plik albo wywołaj API w pętli.
Ile kosztuje duże zlecenie rozpoznawania płci?
Jedno wyszukanie kosztuje jeden credit, więc cena jest ustalona przed startem: najtańsza opublikowana paczka pokrywająca 500 000 imion to €299 netto. Powyżej największej opublikowanej paczki staje się to wyceną, a nie ceną z cennika. Credity kupujesz z góry, nie tracą ważności, a każdy zakup kończy się fakturą VAT.
Czy potrzebuję programisty?
Nie. Wgrywasz plik, wskazujesz kolumnę z imionami i pobierasz gotowy plik — bez linijki kodu. API jest po to, gdy wzbogacanie musi dziać się na bieżąco, a nie jednorazowo.
Czy mój plik Excela wróci nietknięty?
Tak. Formatowanie, formaty liczb i dat, formuły, scalone komórki i wszystkie pozostałe arkusze zostają takie, jakie były; nowe kolumny są wpisywane do Twojego pliku, a nie generowany jest nowy plik z Twoich danych.
Co się dzieje z wierszami, których baza nie potrafi rozstrzygnąć?
Kolumna z płcią zostaje pusta, a liczba próbek mówi dlaczego. Nic nie jest zgadywane po to, by wypełnić lukę — możesz więc odfiltrować te wiersze i sam zdecydować, zamiast odkrywać zgadywanie później.
Czy wgranie masowe jest zgodne z GDPR?
Jesteśmy niemiecką firmą, wszystkie serwery stoją w Niemczech, a dane są przetwarzane na terenie UE. Wgrane pliki są zapisywane w postaci zaszyfrowanej i usuwane po dziesięciu dniach, a umowę o przetwarzaniu danych możesz zamówić w swoim koncie.
Czy mogę spróbować przed zapłatą?
Tak — każde konto zawiera 100 darmowych wyszukań miesięcznie, co wystarczy, by przepuścić próbkę własnej listy i sprawdzić wyniki przed zakupem creditów na cały plik.
ZACZNIJ OD PRÓBKI WŁASNEJ LISTY
100 darmowych wyszukań miesięcznie, bez karty kredytowej — wystarczy, by przepuścić wycinek prawdziwego pliku i sprawdzić wyniki, zanim zapłacisz za całość.
Wgraj plik CSV lub Excel · Dokumentacja API · Zapytaj o większą ilość